# SWE Refactor Bench
> Ficha editorial pública de Research IA. Estado: Lectura primaria pendiente. La interpretación editorial no sustituye la fuente primaria.

- Página canónica: https://luiseduardodemiguel.com/research-ia/papers/swe-refactor-bench
- Fuente primaria: https://arxiv.org/abs/2608.23564
- Versión leída: por verificar
- Fuente comprobada: 2026-08-17 · canonización del radar; lectura completa pendiente
- Autores: Autores pendientes de lectura primaria
- Fecha del corte: 24 AGOSTO 2026; VERSIÓN V1.
- Área: AGENTES · EVALUACIÓN · CODING

## Tesis y contexto

Señal del scout sobre evaluación de refactors de software por agentes.

- Problema: Los tests que pasan no siempre demuestran que una refactorización preserve arquitectura y comportamiento.
- Por qué importa: Podría aportar una prueba más exigente de trabajo de ingeniería, pendiente de verificar.

## Evidencia reportada

- **editorial-synthesis**: Señal del scout sobre evaluación de refactors de software por agentes. [localizador]($first)

## Lectura y límite

- Método: La señal canonizada describe el problema como los tests que pasan no siempre demuestran que una refactorización preserve arquitectura y comportamiento. y sitúa la propuesta en agentes · evaluación · coding. Esta primera ficha conserva la síntesis disponible y deja la fuente primaria enlazada para verificar tarea, datos, actores, baseline y protocolo completo.
- Límite: Esta primera edición se ha generado desde una señal canonizada del radar y no sustituye una lectura completa del paper. No debe interpretarse como validación independiente de sus resultados ni de su transferencia al contexto práctico.
- Confianza editorial: Baja
- Limitación: La evidencia estructurada todavía se apoya en la síntesis canonizada y no en una extracción completa de tablas, figuras o secciones.
- Limitación: La transferencia a producción puede cambiar con el dominio, los datos, las herramientas y el presupuesto de inferencia.

## Localizadores de evidencia
- [Fuente primaria · canonical](https://arxiv.org/abs/2608.23564): tipo abstract
- [Fuente primaria · vista complementaria](https://arxiv.org/html/2608.23564): tipo abstract

## Próxima prueba

- ¿La propuesta mejora coding agents frente a la línea base actual?
- Métrica: Comparar calidad, coste, latencia o tasa de errores antes y después.
- Regla de parada: Parar si no aparece una mejora reproducible o si aumenta el riesgo, la complejidad o el coste sin compensación.

## Recursos reproducibles
- No hay recurso reproducible registrado.

## Enlaces relacionados

- [VAKRA](https://luiseduardodemiguel.com/research-ia/markdown/papers/vakra)
- [The Devil Is in the Interface](https://luiseduardodemiguel.com/research-ia/markdown/papers/devil-interface)
- [SkillSentry](https://luiseduardodemiguel.com/research-ia/markdown/papers/skillsentry)