AI Solutions · Verdieping
RAG-kennisbank: antwoorden verankerd in bronnen, nooit verzonnen
We bouwen kennisbanken die alleen antwoorden vanuit geverifieerde bronnen: hybride retrieval, grounding op documenten, traceerbare citaties, hallucinatiebeheersing en continue evaluatie van de antwoordkwaliteit. Wanneer de bron niet volstaat, verklaart het systeem dat in plaats van te verzinnen.
KENNISBANK · GROUNDED RETRIEVAL
Erin · Gebruikersvraag
Eruit · Geciteerd, verifieerbaar antwoord
Ingestie & chunking van de source of truth
Normaliseert de brondocumenten en splitst ze in coherente fragmenten gedimensioneerd per inhoudstype, waarbij aan elk bronmetadata wordt gehangen — titel, sectie, datum, rechten — die de basis worden van citaties en toegangscontrole: zonder schone ingestie citeert alles stroomafwaarts lucht.
Hybride retrieval (keyword + semantisch)
Combineert een zoekopdracht op trefwoorden (BM25) die productcodes, eigennamen en exacte zeldzame termen vangt met een semantische vectorzoekopdracht die herformuleringen en concepten vangt, en voegt de twee resultaatsets samen op rang (RRF) om terug te halen wat geen van beide alleen zou vinden.
Reranking op een shortlist
Een cross-encoder herrangschikker herordent alleen de smalle shortlist van beste kandidaten door vraag en passage samen te beoordelen in plaats van apart, en voegt een precisiefase toe die nauwkeurig blijft juist omdat hij op enkele fragmenten werkt en niet op de hele index.
Onderbouwde generatie met bronvermelding
Het model antwoordt uitsluitend vanuit de top van de shortlist en citeert de bron van elke bewering, zodat elke zin te herleiden blijft tot een document, een versie en een sectie in plaats van weg te zakken in het trainingsgeheugen.
Grounding- & relevantiecheck / onthouden
Voor levering vergelijkt een grounding- en relevantiecontrole het antwoord met de opgehaalde passages: onder de drempel onthoudt het systeem zich, haalt opnieuw op of geeft door aan een persoon, want een eerlijk «het staat niet in de bronnen» is meer waard dan een plausibel verzinsel.
Evaluatie van antwoordkwaliteit & actualiteit
Trouw, contextrelevantie, antwoordrelevantie, nauwkeurigheid van citaties en freshness van de index worden continu gemeten, want een enkele score verbergt waar het probleem zit en een betrouwbare basis moet eerlijk gehouden worden terwijl documenten en rechten veranderen.
De signalen van een kennisbank die verzint
Een assistent die met overtuiging antwoordt is waardeloos als die overtuiging niet aan een bron verankerd is. Dit zijn de symptomen die we zien voordat we ingrijpen.
- Zelfverzekerd maar fout. Het systeem beweert, op gezaghebbende toon, dingen die in geen enkel intern document staan: dat is ontbrekende grounding, geen typefout.
- Geen verifieerbare citaties. De gebruiker kan een zin niet herleiden tot de bron, en kan die dus niet vertrouwen of corrigeren; elk antwoord is een black box.
- Verouderde inhoud doorgegeven als actueel. Een vorige week bijgewerkt beleid staat nog niet in de index, en het systeem blijft de oude versie met dezelfde overtuiging citeren.
- Perimeterlekken. Een gebruiker krijgt fragmenten van documenten die hij in het bronsysteem helemaal niet mag zien.
- Vragen buiten bereik zonder rem. Wanneer de bronnen tekortschieten, vult het model de leemte met verzinsels in plaats van te verklaren dat het het niet weet.
Voor teams die kritische documentatie, support, compliance of interne kennis beheren en zich geen verzonnen antwoord kunnen permitteren tegenover een klant of een auditor.
Eerst ophalen, dan genereren
Een aan zichzelf overgelaten generatief model voorspelt plausibele tekst. Een RAG-kennisbank keert de volgorde om: het haalt eerst het bewijs uit jouw bronnen en dwingt het model dan om alleen binnen dat bewijs te antwoorden.
Retrieval-Augmented Generation
Voor het antwoord doorzoekt het systeem de documenten op relevante passages en geeft ze aan het model als context, met de instructie om alleen van daaruit te antwoorden. Het model put niet langer uit het trainingsgeheugen maar uit jouw bron van waarheid.
Grounding ≠ correctheid
Grounding controleert of het antwoord trouw is aan de opgehaalde tekst, niet of het absoluut waar is. Als de retrieval het verkeerde fragment ophaalt, betekent een hoge groundingscore alleen dat het model trouw het verkeerde heeft herhaald — daarom moeten retrieval en evaluatie als twee aparte problemen worden behandeld.
Bron van waarheid, geen kopie
De index vervangt je bronsystemen niet; hij weerspiegelt ze. Wanneer een document bij de bron verandert, moet de index meeveranderen, anders liegt de kennisbank met overtuiging over wat vandaag waar is.
Onthouden is een functie, geen gebrek
Een betrouwbare kennisbank weet te zeggen «dit staat niet in de bronnen». Een eerlijke onthouding wint het van een verzonnen antwoord: de bedrijfswaarde zit in niet fout zijn, niet in altijd antwoorden.
Van bron tot geciteerd antwoord
Elke laag versmalt wat het model mag zeggen. De pipeline is geen enkel model: het is een keten van controles, elk met een meetbare taak.
Documenten worden genormaliseerd en opgesplitst in coherente fragmenten, gedimensioneerd per inhoudstype: een beleid wordt anders gesegmenteerd dan een datablad. Elk fragment draagt bronmetadata — titel, sectie, datum, rechten — die de basis worden van citaties en toegangscontrole.
Een zoekopdracht op trefwoorden (BM25) vangt productcodes, eigennamen en exacte zeldzame termen; een semantische vectorzoekopdracht vangt herformuleringen en concepten. De twee resultaatsets worden samengevoegd op rang (RRF), waardoor wordt teruggehaald wat geen van beide alleen zou vinden.
Een cross-encoder herrangschikker ordent de paar beste kandidaten door vraag en passage samen te beoordelen, niet apart. Het is een tweede precisiefase op een shortlist, niet op de hele index — daarom is het nauwkeurig zonder traag te zijn.
Het model antwoordt alleen vanuit de top van de shortlist en citeert de bron van elke bewering. Voor levering vergelijkt een grounding- en relevantiecontrole het antwoord met de passages: onder de drempel onthoudt het systeem zich of haalt opnieuw op in plaats van te publiceren.
Van bron tot geciteerd antwoord in milliseconden, met elke bewering te herleiden tot een passage.
De metrieken die een betrouwbare basis van een plausibele scheiden
Een kennisbank wordt beoordeeld op aparte dimensies, want een enkele score verbergt waar het probleem zit. Dit zijn de hefbomen die we continu monitoren.
| Dimensie | Wat het controleert | Waarom het telt |
|---|---|---|
| Faithfulness (trouw) | Elke bewering in het antwoord wordt gedragen door de opgehaalde passages | De directe rem op hallucinatie: geen bron, geen bewering |
| Contextrelevantie | De opgehaalde passages zijn daadwerkelijk relevant voor de vraag | Meet de retrieval: is die zwak, dan is zelfs een trouw antwoord trouw aan het verkeerde |
| Antwoordrelevantie | Het antwoord behandelt echt de gestelde vraag, zonder af te dwalen | Onderscheidt het relevante van het algemeen correcte maar nutteloze |
| Nauwkeurigheid van citaties | Elke citatie wijst naar de passage die de zin echt onderbouwt | Maakt het antwoord verifieerbaar: de gebruiker herleidt naar de bron en controleert |
| Freshness | De index weerspiegelt de huidige staat van de brondocumenten | Een verouderde index levert antwoorden die vandaag zelfverzekerd maar fout zijn |
De controles die we in productie aan houden
De pipeline bouwen is het halve werk. De andere helft is hem eerlijk houden door de tijd heen, terwijl documenten, rechten en vragen veranderen.
Toegangscontrole binnen de retrieval
Rechten zijn een metadatafilter op zoekmoment: een document dat een gebruiker bij de bron niet mag zien, verschijnt nooit in de resultaten. De beveiligingsperimeter reist mee met de data.
Incrementele indexering
Wanneer een bron verandert, wordt alleen het gewijzigde herverwerkt en de index bijgewerkt met stabiele identifiers. Geen volledige herbouw, geen vensters waarin de basis vanuit oude versies antwoordt.
Onthoudingsdrempels
Onder de grounding- of relevantiedrempel gaat het antwoord niet de deur uit: het systeem verklaart dat het het niet weet, haalt opnieuw op of geeft door aan een persoon. De scope-regel is expliciet, niet aan het toeval overgelaten.
Herkomst en bron van waarheid
Elk antwoord draagt de herkomst van zijn beweringen mee — welk document, welke versie, welke sectie — in de geest van open content-herkomststandaarden zoals C2PA: de geschiedenis van een bewering is verifieerbaar.
Een betrouwbare kennisbank is niet die altijd antwoordt — het is die niet antwoordt wanneer het niet hoort.
Wat teams ons vragen voordat we beginnen
Schakelt RAG hallucinaties volledig uit?
Nee, en wantrouw iedereen die dat belooft. Het vermindert ze aanzienlijk door elk antwoord aan echte bronnen te verankeren, en groundingcontroles plus onthoudingsdrempels stoppen ongedekte antwoorden voordat ze naar buiten gaan. Het doel is een verifieerbaar antwoord, geen daad van geloof.
Wat gebeurt er als het antwoord niet in de documenten staat?
Het systeem zegt het. We bepalen samen met jou de scope-regel: expliciete onthouding, opnieuw ophalen of escalatie naar een persoon. Een eerlijk «het staat niet in de bronnen» wint het van een plausibel verzinsel.
Hoe blijven de antwoorden actueel?
Via incrementele indexering: wanneer een document bij de bron verandert, werkt de index alleen het gewijzigde deel bij, zonder volledige herbouw. Freshness is een metriek die we monitoren, geen sporadische gebeurtenis.
Cases
Van probleem naar resultaat — geanonimiseerd.
Polissen geciteerd, niet verbeeld
Probleem De supportassistent antwoordde zelfverzekerd over clausules en dekkingslimieten terwijl hij putte uit achterhaalde polisversies, zonder dat de medewerker een zin tot de bron kon herleiden.
Methode Bron-van-waarheid-ingestie met versie- en sectiemetadata, hybride retrieval over de contractvoorwaarden, verankerde generatie die elke clausule citeert en een onthoudingsdrempel wanneer de passage het antwoord niet onderbouwt.
Resultaat Elk antwoord draagt zijn document, versie en sectie mee; wanneer de informatie niet in de bronnen staat zegt het systeem het in plaats van te verzinnen, en de medewerker kan verifiëren voordat hij met de klant spreekt.
Datasheets zonder perimeterlekken
Probleem De interne kennisbank gaf technici van verschillende afdelingen fragmenten van vertrouwelijke documentatie terug die ze in het bronsysteem helemaal niet hadden mogen zien.
Methode Toegangscontrole als metadatafilter op retrievalmoment — de beveiligingsperimeter reist mee met de data — plus chunking per inhoudstype dat een datablad anders segmenteert dan een procedure.
Resultaat Een document dat een gebruiker bij de bron niet mag zien verschijnt nooit in de resultaten; de antwoorden blijven geciteerd en verifieerbaar zonder materiaal buiten de perimeter bloot te leggen.
Procedures actueel tot de juiste week
Probleem Klinische procedures veranderden vaak, maar een op schema herbouwde index liet vensters waarin het systeem de oude versie citeerde met dezelfde overtuiging als de actuele.
Methode Incrementele indexering met stabiele identifiers die alleen herverwerkt wat bij de bron verandert, plus freshness behandeld als een continu gemonitorde metriek naast trouw en nauwkeurigheid van citaties.
Resultaat Geen volledige herbouw en geen afwijkingsvensters: de index weerspiegelt de huidige staat van de documenten en de antwoorden houden op vandaag zelfverzekerd maar fout te zijn.
Verdiep verder
Van de index naar een product in productie→
Verankerde retrieval is één laag — de andere vijf die echt verkeer overleven.
Bestuur de adoptie, niet alleen de pipeline→
Wie wat mag vragen, met welke rechten en welke expliciete scope-regels.
Verifieerbare herkomst van beweringen→
De oorsprong van een output traceren in de geest van open standaarden zoals C2PA.