Waardoor verwijzen RAG-citaten naar verouderde documentversies?

Eva Wong is de Technisch Schrijver en en vaste knutselaar bij ZimaSpace. Een levenslange geek met een passie voor homelabs en open-source software, zij is gespecialiseerd in het vertalen van complexe technische concepten naar toegankelijke, praktische handleidingen. Eva gelooft dat zelf-hosting leuk moet zijn, niet intimiderend. Met haar tutorials stelt ze de community in staat om hardware-setup te ontrafelen, van het bouwen van hun eerste NAS tot het beheersen van Docker-containers.

RAG-citaten verwijzen naar verouderde versies wanneer retrieval- en citatiemetadata het niet eens zijn over welke documentstatus momenteel leidend is.

Een private kennisbank kan een beleid, handleiding, factuursjabloon of huishoudelijke procedure bijwerken terwijl het antwoord nog naar de vorige formulering verwijst. Het zichtbare citaat wordt na meerdere afzonderlijke stappen samengesteld: broninname, chunkcreatie, embedding, indexering, retrieval, herordening, generatie en bronweergave. Een versieprobleem kan in elk van deze lagen ontstaan, zelfs wanneer de uiteindelijke link correct wordt geopend en de geciteerde bestandsnaam vertrouwd lijkt.

Het citaat kan correct worden geopend, maar toch naar de verkeerde versie verwijzen

Een citatielink kan de verwachte documentfamilie openen, maar stilzwijgend verwijzen naar een gearchiveerde revisie, een oude momentopname of een chunk die uit een eerdere bestandsstatus is gekopieerd.

Oracle’s richtlijnen voor indexverschuiving beschrijven hoe vervangen chunks doorzoekbaar kunnen blijven wanneer processen voor verwijderen, vervangen en afstemmen niet synchroon blijven.

De kenmerkende observatie is dat de bronnaam correct is, terwijl de geciteerde zin, pagina of revisiemarkering verouderd is. Een volledig ongerelateerde bron wijst eerder op fouten in relevantie van de retrieval of in de citatieweergave.

Onstabiele chunk-ID’s verbreken de koppeling tussen bewijs en bronstatus

Een citaat bevat vaak een document-ID, chunk-ID, pagina, positie of bron-URL. Opnieuw parseren en opdelen in chunks kan dezelfde zin naar een ander record verplaatsen of het oude record aan andere tekst toewijzen.

RAGVersion documenteert versiebeheer op chunkniveau voor veranderende corpora, wat laat zien dat een veranderlijke bron meer nodig heeft dan één tijdloze identificatie.

Als citaten na elke nieuwe indexopbouw enkele regels verschuiven, kan de bron actueel zijn terwijl de positionele verwijzing verouderd is. Als de geciteerde formulering zelf verouderd is, doet er nog steeds een ouder inhoudsrecord mee.

Oude en nieuwe chunks kunnen tegelijkertijd actief blijven

Een updateproces kan de vervangende chunks invoegen voordat het de vorige documentfamilie verwijdert, of verwijderingen helemaal niet verwerken.

Wanneer beide versies hetzelfde onderwerp, dezelfde terminologie en dezelfde structuur hebben, kan de oudere chunk even hoog scoren als de nieuwe. De generator ontvangt dan twee ogenschijnlijk relevante uitspraken zonder te weten welke gezaghebbend is.

Dit patroon leidt tot gemengde antwoorden en afwisselende citaten bij herhaalde zoekopdrachten. Het verschilt van een stabiele maar onjuiste bronkoppeling, die doorgaans telkens dezelfde verkeerde versie teruggeeft.

-15% OFF
Single board computer zimaboard2

Semantische overeenkomst bevat geen informatie over temporele geldigheid

Embeddings plaatsen semantisch verwante tekst dicht bij elkaar, maar markeren niet automatisch de ene uitspraak als actueel en de andere als vervangen.

VersionRAG behandelt veranderende documenten als een afzonderlijk retrievalprobleem en modelleert versiesequenties en documentwijzigingen in plaats van alleen op overeenkomst te vertrouwen.

Een herziene zin kan vrijwel identiek zijn aan de oude zin, op één getal, datum, naam of procedure na. Dat kleine feitelijke verschil kan belangrijker zijn dan hun grote semantische overlap.

Herkomstinformatie van citaten kan na retrieval verloren gaan

De retriever kan de bronmetadata correct teruggeven, maar een latere herordener, contextcompressor, deduplicator of promptbouwer kan de tekst loskoppelen van het oorspronkelijke record.

De OWASP-richtlijnen voor RAG-beveiliging adviseren om bronattributie en herkomstmetadata mee te geven met opgehaald bewijs.

Een verdachte trace bevat antwoordtekst uit de ene chunk, gekoppeld aan de URL of het paginanummer van een andere. Dat is een fout in het koppelen van herkomstgegevens, geen rangschikkingsbeslissing over de actualiteit van het document.

Gecachte retrieval of gegenereerde antwoorden kunnen een oud citaat behouden

Een bronupdate kan de vectorindex vernieuwen terwijl een querycache, herordenaarscache, promptcache of cache voor gegenereerde antwoorden nog steeds een eerdere bewijsset teruggeeft.

Het verouderde resultaat kan pas verdwijnen na het verlopen van de cache, een herstart van de service of een variatie in de zoekopdracht, ook al laat directe inspectie van de index al de huidige chunks zien.

Deze oorzaak is herkenbaar wanneer exact dezelfde zoekopdracht het oude citaat teruggeeft, terwijl een parafrase de nieuwe versie ophaalt. Beide verzoeken kunnen hetzelfde model bereiken, maar verschillende cachesleutels gebruiken.

Versiemetadata heeft geen effect tenzij retrievalfilters deze gebruikt

Het opslaan van velden zoals version, is_current, valid_from of superseded_by verandert een nearest-neighbor-zoekopdracht niet automatisch.

Qdrant ondersteunt payloadfilters tijdens vectorzoekopdrachten, waarmee de kandidaatset vóór het rangschikken kan worden beperkt op basis van geïndexeerde metadata.

Als de toepassing de volledige namespace ophaalt en de versiemetadata pas daarna weergeeft, kan een verouderde chunk nog steeds in de prompt terechtkomen en het uiteindelijke citaat krijgen.

Het filteren op de huidige versie vereist een canonieke bronregel

Een filter heeft een betrouwbare manier nodig om te bepalen welk record actueel is. Alleen de wijzigingstijd kan een gekopieerd archief, een recent aangeraakt oud bestand of een concept promoveren dat de gepubliceerde bron niet hoort te vervangen.

Pinecone documenteert zoeken met metadatafilters, maar de toepassing bepaalt nog steeds de versie- en statusvelden die in de expressie worden gebruikt.

ZimaSpace’s artikel over waarom een AI-NAS-zoekindex meer blootlegt dan alleen bronbestanden verduidelijkt de grens: citaten moeten worden opgelost vanuit een canoniek bron-versierecord, niet vanuit de chunk die toevallig het hoogst scoort.

Veelgestelde vragen

Kan een correct antwoord toch een vervangen citaat bevatten?

Ja. Het model kan het actuele feit uit de ene chunk formuleren, terwijl de citatieweergave metadata uit een ouder of aangrenzend record koppelt.

Verwijdert het verwijderen van het oude bronbestand ook de vectoren?

Niet automatisch. Het ingestiesysteem moet de verwijdering doorgeven of elke afgeleide chunk in de doorzoekbare index als inactief markeren.

Moeten citaten naar chunk-ID’s of document-URL’s verwijzen?

Beide identificaties zijn nuttig. De chunk identificeert het exacte bewijs, terwijl de document-URL en het versierecord een stabiele, voor mensen leesbare bron en geldigheidsstatus bieden.

Tech & AI HUB

Meer om te lezen

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.