Pourquoi les réponses RAG locales semblent-elles meilleures avec les documents narratifs qu’avec les feuilles de calcul ?

Eva Wong est la rédactrice technique et bricoleuse résidente chez ZimaSpace. Geek depuis toujours, passionnée par les homelabs et les logiciels open source, elle se spécialise dans la traduction de concepts techniques complexes en guides accessibles et pratiques. Eva croit que l’auto-hébergement doit être amusant, pas intimidant. À travers ses tutoriels, elle donne à la communauté les moyens de démystifier les configurations matérielles, depuis la construction de leur premier NAS jusqu’à la maîtrise des conteneurs Docker.

Le RAG local répond souvent mieux aux documents narratifs, car le découpage ordinaire préserve le contexte de la prose, mais détruit la structure relationnelle qui donne leur sens aux cellules d’un tableur.

Un paragraphe de politique contient son sujet et ses qualificatifs dans les phrases voisines, tandis que « 42 » dans un classeur peut dépendre d’un intitulé de ligne, d’une date de colonne, d’une unité, d’une formule et du nom de la feuille. Lorsqu’un serveur domestique convertit les deux en blocs de texte brut, le récit survit plus fidèlement à cette transformation que la grille et ses relations intercellulaires implicites lors de la génération de réponses fondées sur les sources.

Les blocs narratifs contiennent leur propre voisinage sémantique

La prose répète les entités, les verbes et les relations de cause à effet dans des phrases adjacentes. Un bloc de taille fixe conserve généralement suffisamment de langage pour qu’un plongement représente le sujet et qu’un générateur interprète les éléments probants. Le chevauchement peut préserver une phrase qui se trouve à cheval sur une limite.

Une approche du RAG axée sur les tableaux indique que le RAG conventionnel fonctionne bien pour les textes narratifs, mais échoue lorsque les informations clés se trouvent dans des tableaux et des structures. Le décalage commence avant la génération, au stade de la représentation et de la récupération.

La qualité narrative peut néanmoins être trompeuse : des passages fluides favorisent des réponses fluides, même lorsque le mauvais bloc a été récupéré. L’avantage comparatif réside dans la préservation de la structure, et non dans la garantie que les réponses narratives sont factuellement exactes.

Le sens d’un tableur réside dans les coordonnées et les opérations

Le sens d’une cellule provient des relations entre les axes. L’aplatissement ligne par ligne peut dissocier les en-têtes, les libellés fusionnés, les formules, les feuilles masquées ou les unités. Les plongements comparent alors des chaînes isolées plutôt que l’opération demandée par une question, comme filtrer un trimestre et additionner une catégorie.

Les recherches sur la topologie des tableaux modélisent explicitement le texte et la topologie des tableaux, car les documents hybrides contiennent des connexions que les blocs linéaires ordinaires perdent. La préservation de l’adjacence et de la hiérarchie modifie les éléments probants pouvant être récupérés.

Même une récupération parfaite peut ne pas suffire à répondre à une question sur un tableur. Le générateur doit sélectionner les cellules, respecter les types de données, effectuer les calculs arithmétiques et citer les coordonnées. Un modèle de langage capable de résumer correctement un paragraphe peut tout de même intervertir des colonnes ou effectuer un calcul sur du texte d’affichage formaté.

Quand le RAG narratif perd son avantage

L’avantage narratif disparaît lorsque les documents contiennent de nombreuses références croisées, de longues annexes ou des faits séparés de leurs définitions. À l’inverse, les tableurs dotés d’en-têtes explicites, de lignes bien structurées et d’une couche de requête sémantique peuvent être plus faciles à interroger qu’une prose ambiguë.

Un guide consacré à l’évaluation du RAG sur des données tabulaires insiste sur l’évaluation à l’aide de questions ancrées dans les tableaux plutôt que sur des métriques génériques de texte. La réponse doit être vérifiée par rapport aux cellules et aux opérations exactes.

Le mécanisme échoue également si les pipelines narratif et tableur utilisent des systèmes OCR, des modèles de plongement ou des autorisations différents. Dans ce cas, le format est confondu avec les outils. « Plus agréable à lire » n’est pas synonyme de meilleur ancrage ; les deux formats nécessitent une vérification au niveau de la réponse.

Évaluez la récupération et le calcul comme deux étapes distinctes

Créez des questions appariées à partir d’un même rapport narratif et d’un classeur bien structuré : questions de recherche, de comparaison, d’agrégation et d’identification d’exceptions. Notez les passages ou les coordonnées des cellules nécessaires, puis faites passer les deux ensembles dans le même modèle avec le même budget de récupération. Évaluez séparément la récupération, le calcul, la citation et la réponse finale.

Utilisez une base de données vectorielle locale pour conserver localement les vecteurs et les fichiers sources tout en comparant une sérialisation tenant compte des tableaux avec un simple texte organisé par lignes. Gardez la température du modèle et l’invite constantes.

Si les éléments probants du tableur sont récupérés, mais que l’arithmétique échoue, ajoutez une étape d’exécution structurée. Si les en-têtes disparaissent avant la récupération, corrigez l’extraction et la sérialisation. Si les réponses narratives semblent seulement meilleures, mais citent les mauvais passages, ajustez l’évaluation au lieu de déclarer le pipeline narratif supérieur.

Centre Tech & IA

Plus à lire

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.