# SWE-Review: Closing the Loop on Issue Resolution with Agentic Code Review
> Ficha editorial pública de Research IA. Estado: Lectura primaria completa. La interpretación editorial no sustituye la fuente primaria.

- Página canónica: https://luiseduardodemiguel.com/research-ia/papers/swe-review-closing-the-loop-on-issue-resolution-with-agentic-code-review
- Fuente primaria: https://arxiv.org/html/2607.06065
- Versión leída: v1
- Fuente comprobada: 2026-08-19 · lectura primaria completa; extracción editorial automatizada, revisión humana pendiente
- Autores: Ruoyu Wang, Jierun Chen, Shaowei Wang, Chaofan Tao, Sidi Yang, Yuxin Jiang, Kim-Hui Yap, Lifeng Shang, Xiaohui Li, Haoli Bai
- Fecha del corte: 7 JULIO 2026.
- Área: AGENTES · EVALUACIÓN · MULTIMODAL

## Tesis y contexto

Añade una etapa de revisión agentic al flujo de resolución de issues. Un agente explora el repositorio, determina si el PR debería aceptarse y emite feedback estructurado para que otro agente revise el parche. Introduce SWE-Review-Bench y SWE-Review-Traj.

- Problema: La mayoría de los coding agents generan un único parche y terminan, sin un ciclo sistemático de revisión y corrección.
- Por qué importa: El patrón generar → revisar → corregir se parece mucho más al desarrollo profesional que el one-shot actual. El trabajo reporta mejoras en decisión de aceptación y tasa de resolución después de la revisión.

## Evidencia reportada

- **reported-result**: Verifier-selected best-of- N has no early-exit mechanism, so every increase in budget incurs the full sampling cost. [localizador](https://arxiv.org/html/2607.06065#S4)

## Lectura y límite

- Método: La lectura de 2 Related Work describe la intervención y su construcción: Coding agents are emerging as a dominant paradigm for repository-level software issue resolution. Modern systems such as Cursor 5 , Claude Code 3 , Codex 23 , Aider 10 , and Devin 7 instantiate this paradigm through agent scaffolds 3 ; 41 ; 46 ; 25 ; 37 ; 34 that interact with development environments, invoke tools, and edit repositories to address real issues. This shift has also motivated a line of software-engineering benchmarks that evaluate agents in increasingly realistic, long-horizon, and repository-grounded settings 13 ; 22 ; 44 ; 8 . Alongside these benchmarks, recent work trains stronger…
- Límite: La lectura primaria permite comprobar método y resultados en el HTML, pero no convierte sus conclusiones en validación independiente. La ficha no demuestra transferencia fuera de los datasets, modelos, herramientas y condiciones descritos en 4 Learning from Agentic Review Trajectories.
- Confianza editorial: Media
- Limitación: El cierre de la fuente señala: The agent-as-judge evaluates the diagnostic accuracy of review reports. Two judge models (Claude Opus 4.6 and GPT-5.4) independently score each review along three axes. This evaluation targets only correct rejections (reviews that correctly identified a non-resolving patch).
- Limitación: La ficha no demuestra transferencia fuera de los datasets, modelos, herramientas y condiciones descritos en 4 Learning from Agentic Review Trajectories.

## Localizadores de evidencia
- [Fuente primaria · canonical](https://arxiv.org/html/2607.06065): tipo abstract
- [Método · 2 Related Work](https://arxiv.org/html/2607.06065#S2): tipo section
- [Evaluación · 4 Learning from Agentic Review Trajectories](https://arxiv.org/html/2607.06065#S4): tipo section
- [Cierre · 5 Conclusion](https://arxiv.org/html/2607.06065#S5): tipo section
- [HTML · fuente navegable](https://arxiv.org/abs/2607.06065): tipo abstract

## Próxima prueba

- ¿La propuesta mejora revisión automática de PRs frente a la línea base actual?
- Métrica: Comparar la métrica principal de la fuente junto con calidad, coste, latencia y tasa de errores.
- Regla de parada: Parar si no aparece una mejora reproducible o si aumenta el riesgo, la complejidad o el coste sin compensación.

## Recursos reproducibles
- [Code](https://github.com/SWE-Lego/SWE-Review)
- [Data](https://huggingface.co/collections/SWE-Lego/swe-review)
- [Plugin](https://github.com/SWE-Lego/cc-swe-review)
- [https://www.anthropic.com/product/claude-code](https://www.anthropic.com/product/claude-code)

## Enlaces relacionados

- [VAKRA](https://luiseduardodemiguel.com/research-ia/markdown/papers/vakra)
- [The Devil Is in the Interface](https://luiseduardodemiguel.com/research-ia/markdown/papers/devil-interface)
- [SkillSentry](https://luiseduardodemiguel.com/research-ia/markdown/papers/skillsentry)