Les réponses fiables viennent de vos sources, pas des suppositions du modèle. Récupération, règles et contrôle humain réduisent le risque.
· 6 min de lecture
Le problème
Pourquoi un modèle de langage invente, et pourquoi lui dire de ne pas le faire ne suffit pas
Un modèle ne sait pas, il prédit
Un modèle de langage ne consulte pas d'archives quand il répond : il génère la suite de mots la plus probable compte tenu du contexte. Quand une question touche des informations absentes de ses données d'entraînement, ou modifiées après celui-ci, le modèle ne s'arrête pas et ne dit pas « je ne sais pas ». Il continue à produire un texte plausible, avec le même ton assuré qu'il emploierait pour une réponse correcte. C'est le mécanisme derrière les fameuses hallucinations : ce ne sont pas des bugs occasionnels à corriger, mais le comportement naturel d'un outil qui optimise la fluidité, pas la vérité.
Plausible ne veut pas dire vrai
Le pire risque n'est pas la réponse manifestement fausse, que l'on repère immédiatement. C'est la réponse vraisemblable : une référence réglementaire qui n'existe pas, une clause contractuelle citée avec aplomb mais inventée, une date ou un chiffre inséré pour compléter la phrase. Dans un contexte d'entreprise, cela transforme un outil utile en source de risque opérationnel et réputationnel. Demander au modèle d'« être précis » ne règle rien, car le modèle n'a aucun moyen de distinguer ce dont il se souvient de ce qu'il construit sur le moment.
Le bon déplacement : de la mémoire à la source
La percée ne consiste pas à choisir un modèle plus gros, mais à changer d'où vient la réponse. Au lieu de laisser le modèle puiser dans sa mémoire statistique, on lui fournit le matériau pertinent au moment de la question et on lui demande de répondre uniquement sur cette base. Le modèle cesse d'être l'archive et devient le lecteur qui synthétise. C'est l'idée à la racine du RAG, retrieval-augmented generation : récupérer d'abord, générer ensuite.
Comment ça marche
Récupérer d'abord, générer ensuite : l'anatomie d'une réponse fiable
La récupération
Quand une question arrive, le système ne la transmet pas directement au modèle. Il cherche d'abord dans vos documents — pages, contrats, procédures, fiches produit — les passages les plus pertinents pour cette demande précise. Cette phase de récupération est le cœur du mécanisme : si elle ramène le bon matériau, la réponse aura un fondement ; si elle ramène un matériau imprécis ou absent, aucun modèle ne pourra compenser. La qualité de la récupération compte plus que la puissance du modèle.
La génération contrainte
C'est seulement maintenant que le modèle entre en jeu, et il reçoit une instruction précise : réponds en utilisant uniquement les passages fournis ; si l'information n'y figure pas, dis-le. La différence avec l'usage libre est nette. Le modèle n'a plus à deviner : il doit lire, sélectionner et reformuler ce qu'il a sous les yeux. Son talent linguistique est mis au service de votre documentation, pas de son imagination.
La citation comme preuve
Une réponse sérieuse indique d'où elle vient. Chaque affirmation importante devrait pouvoir être rattachée au passage du document dont elle est tirée, afin qu'une personne puisse la vérifier en quelques secondes. La citation n'est pas un détail esthétique : c'est ce qui rend la réponse auditable. Sans traçabilité, même une réponse correcte reste un acte de foi ; avec la traçabilité, elle devient une affirmation vérifiable.
Les leviers
Là où le risque d'hallucination se réduit concrètement
01
Des frontières claires sur les sources
Le système répond uniquement à partir d'un ensemble défini et à jour de documents, ni depuis le web entier ni depuis la mémoire interne du modèle. Restreindre le périmètre des sources est le premier moyen d'éviter que les réponses ne dérivent vers des informations non vérifiées.
Une procédure interne obsolète est retirée de l'archive et cesse instantanément d'alimenter les réponses.
02
Le droit du modèle de dire « je ne sais pas »
L'abstention doit être enseignée et récompensée : quand les sources ne contiennent pas la réponse, le système doit le déclarer au lieu de combler le vide. Un « cela ne figure pas dans les documents disponibles » vaut plus qu'une réponse inventée.
Interrogé sur une clause absente, le système répond qu'il ne la trouve pas, au lieu de la reconstituer de mémoire.
03
Mettre à jour les sources, pas réentraîner
Quand une politique change, on met à jour le document et la réponse change avec lui, sans toucher au modèle. Cela maintient le système aligné sur la réalité actuelle de l'entreprise et réduit les réponses fondées sur des informations dépassées.
Une nouvelle condition de retour publiée aujourd'hui se reflète déjà dans les réponses de demain.
04
Une traçabilité vérifiable
Chaque réponse porte ses références aux sources, pour que le lecteur puisse contrôler en autonomie. La vérifiabilité transforme la confiance aveugle en confiance éclairée et permet de corriger le système quand il se trompe.
À côté d'une réponse réglementaire apparaît le lien vers le passage exact du texte cité.
Le point délicat
Gouvernance, confidentialité et RGPD : la bonne récupération pour la bonne personne
Récupérer n'est pas exposer
Donner au système l'accès aux documents de l'entreprise soulève une question de contrôle : tout ce qui est récupérable ne devrait pas l'être pour n'importe qui. Les permissions de la personne qui pose la question doivent s'appliquer aussi à la récupération. Un collaborateur ne doit pas pouvoir obtenir, via une réponse synthétisée, des informations qu'il ne pourrait pas lire en ouvrant le document original. La gouvernance des accès n'est pas une couche au-dessus du système : elle fait partie du système.
Données personnelles et minimisation
Quand les sources contiennent des données personnelles, les principes du RGPD s'appliquent comme à tout autre traitement : base légale, minimisation, finalité définie, conservation limitée. Cela signifie décider consciemment ce qui entre dans l'archive récupérable et ce qui n'y entre pas, et traiter les catégories sensibles avec une prudence particulière. La question n'est pas seulement « le système répond-il bien », mais « utilise-t-il des données qu'il a le droit d'utiliser, pour la finalité pour laquelle elles ont été collectées ».
Journaux, conservation et responsabilité
Un système gouverné laisse une trace : quelles sources ont été consultées, quelle réponse a été donnée, quand. Cela sert à vérifier, à corriger et à démontrer la conformité, mais cela doit être encadré à son tour, car les journaux aussi peuvent contenir des données personnelles et nécessitent une politique de conservation. Une gouvernance mature ne se contente pas de faire fonctionner le système : elle définit qui est responsable de quoi, et combien de temps les informations restent disponibles.
Comment TMM raisonne
Comment TMM raisonne pour mettre en production un système ancré dans les sources
1
Définir le périmètre des sources
Avant de parler de modèles, on décide à quels documents le système peut puiser, qui en est propriétaire et à quelle fréquence ils sont mis à jour. Un périmètre clair est la prémisse de toute réponse fiable.
2
Cartographier permissions et données personnelles
On vérifie qui peut voir quoi et où vivent les données personnelles, en alignant l'accès du système sur l'accès réel des personnes et en appliquant les principes de minimisation dès la conception.
3
Imposer la contrainte des sources
On configure le système pour qu'il réponde uniquement à partir du matériau récupéré et déclare l'absence d'information quand les sources ne suffisent pas. L'abstention est traitée comme une réponse correcte, pas comme un échec.
4
Placer l'humain aux endroits qui comptent
Pour les cas à plus fort impact, la réponse du système est un brouillon qu'une personne relit avant qu'il ne devienne définitif. Le contrôle humain ne ralentit pas tout : il se concentre là où l'erreur coûterait le plus.
5
Mesurer, tracer, corriger
On observe les réponses réelles, on vérifie les citations, on repère les points faibles de la récupération et on agit sur les sources. Le système s'améliore en mettant à jour les documents, pas en courant après des modèles toujours plus gros.
Un parcours ordonné, pas un interrupteur à actionner
FAQ
Questions fréquentes
Le RAG élimine-t-il complètement les hallucinations ?
Non, il les réduit substantiellement mais ne les annule pas. Ancrer le modèle dans vos sources rend l'invention bien plus difficile et rend chaque réponse vérifiable, mais une marge d'erreur subsiste : une récupération imprécise ou une synthèse forcée peuvent encore produire des inexactitudes. C'est pourquoi le contrôle humain sur les cas critiques et la possibilité de vérifier les citations comptent.
Faut-il réentraîner le modèle sur nos données ?
Presque jamais, et c'est rarement la première chose à faire. Dans la plupart des cas, il est plus efficace et plus sûr de fournir les documents au moment de la question : vous mettez à jour une source et la réponse change, sans intervention sur le modèle et sans incorporer vos données de façon permanente. C'est aussi une approche plus respectueuse de la vie privée, car les données restent dans les sources que vous contrôlez.
Que se passe-t-il si un document est faux ou obsolète ?
Le système répondra selon ce document, parce qu'il fait confiance aux sources que vous lui donnez. C'est le point central : la qualité des réponses dépend de la qualité et de la fraîcheur de l'archive. C'est pourquoi la maintenance des sources — retirer ce qui est obsolète, mettre à jour ce qui change — fait partie intégrante du système et n'est pas une activité accessoire.
Pouvons-nous contrôler qui voit quelles informations ?
Oui, et c'est une exigence, pas une option. La récupération doit respecter les permissions de la personne qui interroge : nul ne doit obtenir via une réponse ce qu'il ne pourrait pas lire directement. Avec la minimisation des données personnelles et une politique de conservation des journaux, c'est ce qui rend le système compatible avec le RGPD et vos règles internes.
Ce site utilise uniquement les technologies nécessaires et les préférences que vous demandez. L’analytique, la publicité et le profilage ne sont pas installés.
NécessairesToujours actifs
AnalytiqueNon utilisés
Publicité et profilageNon utilisés
Le panneau TMM apparaît lorsque le service Iubenda est indisponible. Il n’active aucun service facultatif.