Cada resposta de IA local precisa de um percurso de origem rastreável, para que as suas afirmações possam ser verificadas face aos ficheiros, versões e transformações exatos utilizados.
Uma citação que diga «manual da casa» é insuficiente quando existem três cópias, uma foi processada por OCR e apenas uma corresponde à revisão mais recente. A linhagem dos dados regista o percurso desde o ficheiro original, passando pela análise, divisão em blocos, criação de embeddings, recuperação, montagem do prompt e segmento da resposta. Esse percurso permite diagnosticar problemas de atualidade, acesso e transformação sem enviar documentos privados para outro local nem enfraquecer o controlo local.
A linhagem liga a resposta à sua cadeia de transformação
Um registo útil começa pela identidade e versão da fonte e, em seguida, capta os resultados da análise e do OCR, os limites dos blocos, o modelo de embeddings, a geração do índice, o resultado da recuperação e a posição no prompt. As afirmações da resposta apontam para IDs de blocos que remetem para segmentos ou regiões de páginas do original.
Uma análise detalhada da linhagem das fontes RAG descreve o rastreio de fontes RAG e entradas de agentes, para que uma resposta possa ser associada à origem, atualidade e autorização da fonte. Demonstra por que motivo a observabilidade dos modelos deve incluir artefactos de dados, e não apenas latência e tokens.
Esta cadeia separa falhas que parecem idênticas à superfície. Uma resposta errada pode resultar de bytes de origem desatualizados, de uma omissão do analisador, de um bloco incorreto, de uma falha na recuperação ou de uma geração sem suporte; a linhagem identifica a fase em que ocorreu a primeira divergência.
Os IDs estáveis preservam os percursos durante a reindexação
Os caminhos e nomes dos ficheiros mudam, pelo que a linhagem precisa de identificadores estáveis de documentos e versões, além de mapeamentos para as localizações atuais. Cada transformação deve registar os IDs de entrada, os IDs de saída, a configuração, o carimbo de data e hora e o estado, formando um grafo direcionado de artefactos derivados.
Um design prático de rastreio de identificadores de fontes associa identificadores de fontes aos blocos recuperados e liga as falhas comunicadas à consulta, ao contexto e ao registo exato da resposta. Esta abordagem leve permite a reconstrução posterior, mesmo numa pequena infraestrutura autoalojada.
As relações entre versões distinguem a substituição da duplicação. Uma resposta anterior pode manter a versão que utilizou, enquanto uma consulta atual filtra para a versão ativa. A eliminação de um ficheiro deve retirar os artefactos pesquisáveis, sem apagar o registo de auditoria necessário para explicar respostas históricas.
Uma citação visível ainda pode ocultar um percurso corrompido
O documento apresentado pode estar correto, enquanto o segmento citado veio de outra versão, ou o modelo pode associar uma citação plausível depois de gerar a resposta com base em conhecimento prévio sem suporte. A linhagem regista a disponibilidade e o percurso; por si só, não prova que o texto citado sustenta a afirmação.
O enquadramento de rastreabilidade das evidências dá ênfase à confiança na geração e à rastreabilidade das evidências ao analisar o comportamento do RAG. A sua perspetiva estruturada ilustra por que motivo as evidências recuperadas e as afirmações geradas devem permanecer ligadas a um nível mais granular do que uma única lista de fontes para toda a resposta.
O limite da falha corresponde a qualquer ligação de transformação em falta ou versão da fonte não resolvida. Marque a afirmação como não verificável, preserve o registo incompleto para diagnóstico e evite apresentar um distintivo de citação polido como prova de suporte. Esta distinção continua visível durante os testes domésticos posteriores.
Rastreie uma afirmação para trás através de todas as fases
Selecione cinco respostas que contenham texto obtido por OCR, documentos atualizados, ficheiros duplicados e uma fonte eliminada. Começando por uma afirmação, resolva a respetiva citação até ao bloco, bloco analisado, versão do documento, caminho original, evento de ingestão e decisão de acesso, sem consultar conhecimentos não documentados do operador.
Compare o resultado com a reconstrução no registo de eventos apresentada em registos de auditoria de agentes. A linhagem deve explicar a derivação dos dados, enquanto o registo de auditoria explica decisões e ações; associe os respetivos identificadores sem os tratar como o mesmo registo. O resultado intermédio deve continuar a ser inspecionável antes de a automatização prosseguir.
Considere aprovado apenas se todas as afirmações atuais chegarem a um segmento de fonte acessível e todas as afirmações históricas chegarem à sua versão retida ou a um marcador explícito de eliminação. Qualquer ligação quebrada torna-se uma falha do pipeline, não um problema meramente cosmético de citação.
Centro de Tecnologia e IA
Mais para Ler

Que fatores determinam a precisão das citações RAG numa base de conhecimento doméstica?
Saiba por que motivo uma fonte relevante pode ainda assim ser uma citação incorreta, que fases do pipeline controlam o suporte e a cobertura,...

Que funcionalidades permitem obter uma saída JSON fiável de um LLM local?
Veja quais funcionalidades impõem a sintaxe JSON, quais protegem a correção semântica e como testar um modelo local com diferentes esquemas, prompts e casos...

Indexação por hash de conteúdo: como as impressões digitais dos ficheiros evitam trabalho redundante de IA
Saiba como as impressões digitais de ficheiros e blocos orientam a indexação incremental, por que razão os metadados são insuficientes e em que casos...

