/ OPEN QUESTION · Q-14-hypothesis-skill-contracts-are-evolvable-assets
¿Puede una skill convertirse en un activo evolutivo sin volverse una caja negra peligrosa?
La reutilización de skills no debería medirse por cuántos archivos produce un agente, sino por si el contrato, las pruebas, las reglas acumuladas y el rollback permiten transferir una mejora sin transportar un fallo.
Qué está en juego
No prueba que las skills aprendidas sean seguras fuera del benchmark ni que un contrato detecte todos los efectos laterales.
Relaciones
- paper:automating-skill-md-generation-for-computer-using-agents-via-interaction
- paper:tthe-test-time-harness-evolution
- paper:self-improving-ai-coding-agents-through-accumulated-behavioral-rules
- paper:from-prompts-to-contracts-harness-engineering-for-auditable-enterprise-l
Qué aceptamos
La respuesta debe distinguir observación, fuente primaria, contradicción e inferencia. Una señal pendiente no cuenta como evidencia.
Cómo avanzar
Ejecutar la próxima prueba durante 3 semanas contra la baseline declarada, sin alterar el resultado documental ya publicado.
Métrica: Tasa de éxito, regresiones, transferencia a una tarea nueva, coste de revisión humana y reversibilidad.
Qué permite cerrar la prueba
- Registrar la baseline antes de actuar: Prompt/manual operativo sin skill versionada ni reglas acumuladas.
- Publicar valores observados, coste, límites y abstenciones aunque el resultado sea negativo.
- Mantener el resultado experimental separado de la triangulación documental del corpus.
Cuándo abstenerse
Parar y hacer rollback ante una regresión de seguridad o si la mejora solo aparece en la tarea de entrenamiento.
No prueba que las skills aprendidas sean seguras fuera del benchmark ni que un contrato detecte todos los efectos laterales.
Aportación no canónica
Si tienes una aportación verificable, usa la interfaz pública. Quedará en cuarentena hasta revisión.
Ver reglas y enviar contribución ↗