LexiqueÉtage 2
Étage 2 sur 4
Le Harnais
Tout ce qu’on construit autour du modèle pour le rendre utile : instructions, mémoire, accès aux documents et aux outils.
Les termes de cet étage
22 fiches- APINº 040Une API est une porte d’entrée prévue pour les logiciels : un programme demande, un autre répond, dans un format convenu. Comme un distributeur automatique : on n’explique rien à un vendeur, on introduit ce qu’il attend et on reçoit ce qu’il rend.
- appel d’outilsNº 038L’appel d’outils est le moment où le modèle réclame une action au lieu de rédiger : chercher un fichier, envoyer un message. Comme un client qui remplit un bon de commande : il inscrit ce qu’il veut, quelqu’un d’autre va le chercher et le lui rapporte.
- assistantNº 002Un assistant est un produit qui attend votre message, vous répond, puis s’arrête. Comme un guichet : vous posez une question, on vous répond, et rien ne se passe tant que vous ne demandez rien. C’est vous qui menez l’échange, à chaque tour.
- base vectorielleNº 042Une base vectorielle range des textes selon leur sens plutôt que selon leurs mots, pour retrouver ceux qui ressemblent à votre question. Comme un rayon de magasin où les articles voisins servent au même usage : on trouve sans connaître le nom exact.
- cache de promptNº 066Le cache de prompt conserve le travail déjà fait sur le début d’une entrée, de sorte qu’une requête qui commence par le même texte n’a pas à le refaire. Comme une machine déjà préchauffée : on ne recommence pas la montée en température à chaque fournée.
- chatbotNº 015Un chatbot est un programme avec lequel on échange par messages, comme au guichet : vous posez une question, il répond, et tout se passe dans le fil. C’est une manière de présenter un service, pas une technologie particulière.
- contexteNº 008Le contexte est l’ensemble du texte que le modèle a sous les yeux au moment où il répond : votre question, l’historique, les documents ajoutés. Comme le dossier posé devant quelqu’un avant un entretien : ce qui n’y figure pas n’existe pas pour lui.
- découpage (chunking)Nº 065Le découpage consiste à trancher vos documents en fragments avant de les indexer, puisque c’est un fragment, et non un document entier, que la recherche remontera. Comme découper un manuel en fiches : la coupe décide de ce qu’on retrouvera, et de ce qui restera incompréhensible.
- few-shotNº 081Le few-shot consiste à placer dans la demande deux ou trois exemples de ce qu’on attend, entrée et sortie, au lieu de le décrire. Comme tendre à quelqu’un trois formulaires déjà remplis plutôt que de lui expliquer comment remplir le formulaire.
- garde-fousNº 041Les garde-fous sont les limites posées autour d’un système d’IA pour que ses erreurs restent sans gravité : ce qu’il ne peut pas déclencher seul, ce qu’une personne doit valider. Comme la rambarde d’un balcon : elle n’empêche pas de se pencher, elle empêche la chute.
- harnaisNº 003Le harnais est tout ce qu’on construit autour d’un modèle pour le rendre utile : instructions, documents, outils, garde-fous. Comme une voiture autour d’un moteur : sans carrosserie, sièges ni volant, la mécanique tourne, mais personne ne va nulle part.
- ingénierie de promptNº 067L’ingénierie de prompt est le travail consistant à formuler ce qu’on demande au modèle, avec ses exemples et son format de sortie, puis à vérifier que la formulation tient sur des cas réels. Comme rédiger une consigne pour un intérimaire compétent qui ne connaît ni la maison ni le dossier.
- injection de promptNº 096L’injection de prompt consiste à glisser dans un texte lu par le système une consigne qui prend le pas sur celle du concepteur, parce que le modèle reçoit les deux comme un seul texte et ne sait pas laquelle fait autorité. Comme une note anonyme glissée dans un dossier remis à un employé : il la lit avec le reste, et rien, sur le papier, ne dit qu’elle ne vient pas de sa direction.
- MCPNº 039MCP est une prise standard entre le logiciel qui pilote un modèle et les outils ou documents auxquels il doit accéder. Comme une prise électrique normalisée : chaque appareil se branche sans câble sur mesure, et en changer ne demande pas de refaire l’installation.
- mémoireNº 009La mémoire est ce qu’un produit décide de conserver entre vos échanges, puis de redonner à lire au modèle quand c’est utile. Comme un carnet tenu par un collègue : lui ne se souvient de rien, mais il relit ses notes avant chaque rendez-vous.
- modérationNº 044La modération est le tri des contenus qui entrent et sortent d’un système d’IA : ce qu’on refuse de traiter, ce qu’on refuse de laisser passer. Comme le contrôle à l’entrée d’une salle : on regarde ce qui franchit la porte, dans les deux sens.
- outilNº 012Un outil est une action que le modèle peut réclamer à un logiciel : chercher sur le web, lire un fichier, envoyer un message. Comme un client au restaurant : il commande, il ne va pas en cuisine, et on lui rapporte le plat.
- promptNº 010Le prompt est le texte que vous adressez au modèle : votre demande, avec ce qu’il faut savoir pour y répondre. Comme une consigne laissée à quelqu’un qui arrive sans connaître ni vous ni le dossier : plus elle est précise, moins il improvise.
- prompt systèmeNº 037Le prompt système, ce sont les consignes permanentes qu’un produit place devant chaque demande : le ton, le rôle, les interdits. Comme le règlement affiché à l’entrée d’une piscine : il vaut pour tout le monde, avant même que vous ayez dit un mot.
- RAGNº 013Le RAG consiste à chercher les documents utiles à votre question, puis à les donner à lire au modèle avant qu’il réponde : comme un collègue qui, avant de vous répondre, va sortir le bon classeur et le relit devant vous.
- recherche webNº 064La recherche web est l’outil qui permet à un modèle d’aller chercher des pages en ligne et de les lire avant de répondre, au lieu de s’en tenir à ce qu’il a appris. Comme un bibliothécaire qui sort consulter la presse du jour plutôt que de citer ses souvenirs.
- sortie structuréeNº 043Une sortie structurée est une réponse contrainte à respecter une forme précise, pour qu’un autre logiciel puisse la lire directement. Comme un formulaire plutôt qu’une lettre libre : les cases sont imposées, ce qui ne dit rien de la justesse de ce qu’on y écrit.
Les autres étages
La grille- Étage 1 · Le Modèleun bloc plein, seul : la machine à prédireLe ModèleUne machine à prédire la suite d’un texte.
- Étage 3 · L’Agentle bloc pris dans une boucle : il recommence jusqu’au résultatL’AgentLe modèle en boucle vers un objectif.
- Étage 4 · L’Organisationune mosaïque : l’IA n’y est qu’une case parmi d’autresL’OrganisationRègles, coûts, compétences, habitudes.
La planche L’Ascenseur est la carte de ces quatre étages : une même demande y est relue à chaque niveau.