Una canalización RAG puede citar el archivo correcto, pero el pasaje equivocado, cuando el descubrimiento del documento funciona, pero falla la recuperación de fragmentos o la asignación de citas.
Los archivos grandes suelen contener muchas secciones que comparten terminología, encabezados repetidos, ejemplos similares o varias versiones del mismo dato. Un recuperador a nivel de archivo puede identificar correctamente el manual, informe o nota doméstica pertinente, mientras que la etapa a nivel de pasaje selecciona un fragmento vecino. Entonces, el modelo de respuesta puede inferir el detalle que falta a partir de sus propios conocimientos o de otro fragmento, pero adjuntar los metadatos del archivo seleccionado. Una citación fiable requiere corrección independiente en las etapas de documento, página, fragmento, intervalo y generación.
La recuperación de documentos y la recuperación de pasajes son problemas distintos
Un archivo puede obtener una posición alta porque su título, sus metadatos o su incrustación general coinciden con la pregunta. Eso no demuestra que el párrafo que contiene la respuesta aparezca en el conjunto de fragmentos recuperados.
Una guía práctica sobre fallos de RAG separa las capas de fallos de recuperación y recomienda inspeccionar los fragmentos exactos, no solo la respuesta final.
La canalización debería medir por separado la recuperación de documentos, páginas y fragmentos. Un nombre de archivo correcto puede ocultar que no se recuperó el intervalo que contiene la respuesta.
Los límites de los fragmentos pueden separar la evidencia de su contexto
Una división de tamaño fijo puede colocar un encabezado en un fragmento, la afirmación en otro y la excepción o etiqueta de la tabla en un tercero.
La guía de Edtek describe cómo unos límites de fragmento incorrectos producen pasajes que mencionan la consulta, pero no contienen la respuesta completa.
El recuperador aún puede seleccionar el archivo correcto porque muchos fragmentos comparten el tema. El generador recibe un pasaje incompleto y cita la fuente a nivel de archivo como si demostrara la afirmación.
La división estructural en fragmentos, la recuperación padre-hijo y la expansión a fragmentos vecinos solo ayudan cuando los desplazamientos de origen siguen siendo trazables.
Los metadatos de las citas pueden asociarse con una granularidad incorrecta
Algunas canalizaciones copian una URL o un nombre de archivo de documento en cada fragmento sin almacenar la página, la sección, el cuadro delimitador ni los desplazamientos de caracteres.
La guía de citas de Tensorlake muestra cómo los anclajes espaciales pueden pasar del preprocesamiento del documento a la recuperación y la generación de respuestas.
Un puntero que solo identifica el archivo demuestra de dónde procede el elemento del corpus, no qué bytes respaldan la oración. Las citas a nivel de pasaje necesitan una identidad estable del fragmento y metadatos de ubicación.
El OCR, la redistribución del texto en PDF y los documentos editados pueden invalidar los desplazamientos, a menos que la cita también registre la instantánea indexada o el hash del contenido.
Los pasajes similares pueden hacer que el generador mezcle identificadores
El contexto puede contener varios fragmentos del mismo archivo con un lenguaje similar. El modelo puede utilizar el contenido de un pasaje y emitir la etiqueta de cita de otro fragmento cercano.
Un artículo sobre RAG crítico para las citas advierte que los errores en pasajes cercanos siguen siendo posibles incluso cuando el documento citado es una fuente autorizada.
Asigna a los fragmentos identificadores claros y no similares, y mantén la cita junto al texto que la respalda. Pedir al modelo que recuerde un mapa de citas separado después de la síntesis aumenta el riesgo de discrepancias.
La verificación determinista de cita a fragmento puede detectar cuándo el pasaje citado no contiene el texto afirmado o entrecomillado.
La reordenación debe puntuar el respaldo del pasaje, no solo la similitud temática
Un recuperador de primera etapa puede devolver muchos fragmentos del archivo correcto. Un reordenador debería distinguir la sección que responde directamente a la consulta de las secciones que simplemente comparten el tema.
La guía de Databricks sobre división en fragmentos destaca que las unidades de recuperación coherentes son necesarias para que las etapas posteriores puedan ordenar los pasajes con precisión.
Reordena usando la consulta completa, conserva el encabezado y el contexto principal del pasaje, y penaliza los fragmentos que no contengan el campo, la fecha, la entidad o el tipo de evidencia solicitados.
El flujo de trabajo de búsqueda de documentos de ZimaSpace trata estos aspectos como etapas independientes, no como una única puntuación genérica de «calidad RAG».
Verifica el pasaje exacto antes de mostrar la cita
Después de la generación, asigna cada oración factual o cita al fragmento que contiene su respaldo. Rechaza las citas que solo apuntan al archivo correcto.
Infolitz recomienda asociar las citas con fragmentos que contienen la fuente, en lugar de reconstruirlas a nivel de archivo completo.
Evalúa la precisión de los pasajes, la integridad de la evidencia, la contención de las citas textuales, la validez de los desplazamientos de las citas y si el intervalo citado respalda la afirmación exacta generada.
El sistema solo está corregido cuando hacer clic en la cita abre el pasaje mínimo suficiente, no simplemente el documento correcto en algún lugar cercano a la respuesta.
Centro de Tecnología e IA
Más para leer

¿Qué funciones permiten establecer un límite de confianza de IA doméstica alrededor de archivos confidenciales?
Un límite de confianza para la IA doméstica combina cifrado en reposo, permisos de mínimo privilegio, aislamiento del entorno de ejecución y recuperación con...

¿Qué hace que los resultados de búsqueda privados favorezcan los archivos editados con frecuencia?
Los archivos editados con frecuencia obtienen ventajas de posicionamiento cuando cada actualización añade señales de frescura, fragmentos, versiones o interacción sin normalizarlas por fuente.

¿Qué hace que los modelos de presencia del hogar inteligente confundan a los invitados con los residentes?
Los invitados pueden parecer residentes cuando el sistema observa patrones de actividad del hogar, pero carece de una señal de identidad estable de la...

