/ OPEN QUESTION · Q-16-concept-uncertainty-and-abstention
¿La abstención correcta reduce más riesgo que una respuesta de baja confianza?
Un sistema útil explicita cuándo no tiene fuente, no puede responder o necesita una decisión humana antes de continuar.
Qué está en juego
Parar si el agente se abstiene ante casos resolubles o responde sin declarar el hueco.
Relaciones
- concept:concept:uncertainty-and-abstention
- paper:code-is-more-than-text-uncertainty-estimation-for-code-generation
- paper:atomic-intent-reasoning-bringing-llm-semantics-to-industrial-cross-domai
- paper:rethinking-shrinkage-bias-in-llm-fp4-pretraining-geometric-origin-system
- paper:supersede-diagnosing-and-training-the-memory-update-gap-in-llm-agents
Qué aceptamos
La respuesta debe distinguir observación, fuente primaria, contradicción e inferencia. Una señal pendiente no cuenta como evidencia.
Cómo avanzar
Ejecutar una comparación acotada durante 1 semana y registrar el resultado junto al concepto, sin promover la coincidencia semántica a relación causal.
Métrica: abstención correcta, falsos positivos, cobertura útil y tiempo hasta resolución
Qué permite cerrar la prueba
- Conservar configuración, muestra y baseline suficientes para repetir la comparación.
- Registrar el valor observado y cualquier resultado negativo o contradictorio.
- Separar soporte documental, inferencia editorial y resultado del experimento.
Cuándo abstenerse
Parar si el agente se abstiene ante casos resolubles o responde sin declarar el hueco.
El cluster semántico indica una conexión para investigar; no demuestra un mecanismo compartido. Huecos actuales: ninguno adicional registrado.
Aportación no canónica
Si tienes una aportación verificable, usa la interfaz pública. Quedará en cuarentena hasta revisión.
Ver reglas y enviar contribución ↗