# Before Reasoning Can Fail: Pre-Evidence Procedural Failures in Agentic RAG
> Ficha editorial pública de Research IA. Estado: Lectura primaria completa. La interpretación editorial no sustituye la fuente primaria.

- Página canónica: https://luiseduardodemiguel.com/research-ia/papers/before-reasoning-can-fail
- Fuente primaria: https://arxiv.org/abs/2608.02011
- Versión leída: v2
- Fuente comprobada: 2026-08-20 · versión v2 contrastada; método, resultado y límites revisados
- Autores: Daeyoung Roh y Donghee Han
- Fecha del corte: 03 AGO 2026
- Área: AGENTIC RAG · EVALUACIÓN · PROCEDIMIENTO

## Tesis y contexto

El paper separa los fallos procedimentales previos a la evidencia de los errores posteriores de lectura y razonamiento, y evalúa Read-Gate como una invariante mínima que obliga a leer antes de finalizar.

- Problema: Los sistemas suelen culpar al retriever o al razonamiento cuando el harness permite la secuencia search → final answer sin exigir search → read → answer.
- Por qué importa: Añadir una regla pequeña puede mejorar más que añadir tokens de pensamiento: la disciplina del procedimiento merece su propia métrica y su propio control.

## Evidencia reportada

- **reported-result**: Read-Gate mejora entre 14,9 y 19,9 puntos en las trayectorias que se habrían saltado la lectura. [localizador](https://arxiv.org/html/2608.02011v2#S5)

## Lectura y límite

- Método: Descompone trayectorias de agentic RAG en fallos de disciplina —buscar pero no leer— y fallos posteriores a una lectura válida; después evalúa Read-Gate como restricción de runtime.
- Límite: Read-Gate obliga a que ocurra una lectura, no a que se lea el chunk correcto ni a que el razonamiento posterior sea válido; la garantía es procedimental, no una prueba de verdad.
- Confianza editorial: Alta
- Limitación: El efecto se estima sobre trayectorias emparejadas que habrían omitido lectura en tres benchmarks QA; la selección del subconjunto puede inflar la ganancia condicional.
- Limitación: Leer antes de razonar puede mejorar evidencia y también añadir coste o falsas abstenciones; los resultados no prueban el mismo equilibrio en documentos abiertos y cambiantes.

## Localizadores de evidencia
- [Fuente primaria · canonical](https://arxiv.org/abs/2608.02011): tipo abstract
- [Read-Gate y Figura 4 · HTML v2](https://arxiv.org/html/2608.02011v2#S5): tipo figure
- [HTML · fuente navegable](https://arxiv.org/html/2608.02011): tipo abstract

## Próxima prueba

- ¿Read-Gate mejora la respuesta y las citas sin convertir consultas sencillas en lecturas innecesarias?
- Métrica: Exactitud, precisión de citas, tokens, latencia, omisiones de evidencia y falsas abstenciones.
- Regla de parada: Parar si la exactitud no aumenta 5 puntos en consultas multi-hop o si las falsas abstenciones superan 10%.

## Recursos reproducibles
- [HTML · versión v2](https://arxiv.org/html/2608.02011v2)

## Enlaces relacionados

- [The Devil Is in the Interface](https://luiseduardodemiguel.com/research-ia/markdown/papers/devil-interface)
- [RAG-Stack](https://luiseduardodemiguel.com/research-ia/markdown/papers/rag-stack)
- [Diagnosis Before Recovery](https://luiseduardodemiguel.com/research-ia/markdown/papers/diagnosis-before-recovery)