Perché le risposte RAG locali sembrano migliori sui documenti narrativi che sui fogli di calcolo?

Eva Wong è la Technical Writer e smanettatrice residente di ZimaSpace. Una geek da sempre con una passione per homelab e software open-source, si specializza nel tradurre concetti tecnici complessi in guide accessibili e pratiche. Eva crede che l'auto-ospitare debba essere divertente, non intimidatorio. Attraverso i suoi tutorial, dà potere alla comunità di demistificare le configurazioni hardware, dalla costruzione del loro primo NAS al dominio dei container Docker.

Il RAG locale spesso risponde meglio sui documenti narrativi perché il chunking ordinario preserva il contesto della prosa, ma interrompe la struttura relazionale che dà significato alle celle dei fogli di calcolo.

Un paragrafo normativo contiene il soggetto e le precisazioni nelle frasi vicine, mentre “42” in una cartella di lavoro può dipendere dall’etichetta della riga, dalla data della colonna, dall’unità, dalla formula e dal nome del foglio. Quando un home server converte entrambi in semplici blocchi di testo, la narrazione sopravvive alla trasformazione più fedelmente rispetto alla griglia e alle sue relazioni nascoste tra celle durante la generazione di risposte basate sulle fonti.

I blocchi narrativi contengono il proprio contesto semantico

La prosa ripete entità, verbi e relazioni causali tra frasi adiacenti. Un blocco di dimensione fissa conserva di solito abbastanza linguaggio perché un embedding rappresenti l’argomento e un generatore interpreti le prove. La sovrapposizione può preservare una frase che attraversa un confine.

Un approccio RAG basato innanzitutto sulle tabelle osserva che il RAG convenzionale funziona bene per il testo narrativo, ma presenta problemi quando le informazioni chiave si trovano in tabelle e strutture. La discrepanza inizia prima della generazione, durante la rappresentazione e il recupero.

La qualità narrativa può comunque essere ingannevole: i passaggi scorrevoli favoriscono risposte scorrevoli anche quando è stato recuperato il blocco sbagliato. Il vantaggio comparativo consiste nella preservazione strutturale, non nella garanzia che le risposte in prosa siano fattualmente corrette.

Il significato dei fogli di calcolo risiede nelle coordinate e nelle operazioni

Il significato di una cella deriva dalle relazioni tra gli assi. L’appiattimento riga per riga può separare intestazioni, etichette unite, formule, fogli nascosti o unità di misura. Gli embedding confrontano quindi stringhe isolate anziché l’operazione richiesta da una domanda, come filtrare un trimestre e sommare una categoria.

La ricerca sulla topologia delle tabelle modella esplicitamente il testo e la topologia delle tabelle perché i documenti ibridi contengono connessioni che i normali blocchi lineari perdono. Preservare adiacenza e gerarchia cambia le prove che possono essere recuperate.

Anche un recupero perfetto potrebbe non essere sufficiente per completare una domanda su un foglio di calcolo. Il generatore deve selezionare le celle, rispettare i tipi di dati, eseguire i calcoli e citare le coordinate. Un modello linguistico che riassume bene un paragrafo può comunque scambiare le colonne o calcolare sui valori testuali visualizzati e formattati.

Quando il RAG narrativo perde il suo vantaggio

Il vantaggio narrativo scompare quando i documenti contengono numerosi riferimenti incrociati, appendici lunghe o fatti separati dalle relative definizioni. Al contrario, i fogli di calcolo con intestazioni esplicite, righe ordinate e un livello semantico per le query possono essere più facili da interrogare rispetto a una prosa ambigua.

Una guida alla valutazione del RAG tabellare sottolinea l’importanza di valutare il sistema con domande basate sulle tabelle anziché con metriche generiche per il testo. La risposta dovrebbe essere verificata rispetto alle celle e alle operazioni esatte.

Il meccanismo fallisce anche se le pipeline per la narrazione e i fogli di calcolo utilizzano OCR, modelli di embedding o autorizzazioni diversi. In questo caso, il formato è confuso con gli strumenti. “Più gradevole” non equivale a meglio fondato sulle fonti; entrambi i formati richiedono una verifica a livello di risposta.

Valuta il recupero e il calcolo come fasi separate

Crea domande abbinate a partire da un rapporto narrativo e da una cartella di lavoro ordinata: domande di ricerca, confronto, aggregazione ed eccezione. Registra i passaggi o le coordinate delle celle necessari, quindi sottoponi entrambi allo stesso modello e allo stesso budget di recupero. Valuta separatamente recupero, calcolo, citazione e risposta finale.

Utilizza un database vettoriale locale per conservare localmente i vettori e i file sorgente mentre confronti la serializzazione consapevole delle tabelle con il semplice testo delle righe. Mantieni fissi la temperatura del modello e il prompt.

Se le prove del foglio di calcolo vengono recuperate ma il calcolo aritmetico non riesce, aggiungi un passaggio di esecuzione strutturato. Se le intestazioni scompaiono prima del recupero, correggi l’estrazione e la serializzazione. Se le risposte narrative sembrano soltanto migliori ma citano passaggi errati, modifica la valutazione invece di dichiarare superiore la pipeline per la prosa.

Hub Tecnologico e AI

Altro da leggere

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.