NOTAS DE CAMPO / LDM ZARAGOZA / CALATAYUD · 2026

/ LAB · MESA DE CAMPO · AGENT CONTROL PLANE

ESTADO / 2026-08-17

Investigar es coordinar evidencia y decisiones.

La Mesa de campo reúne los roles que hacen avanzar Research IA: descubrir, leer, localizar, relacionar, revisar y sintetizar. No es un dashboard de actividad; es una frontera explícita entre lo que puede proponer un agente y lo que todavía debe decidir una persona.

01THE LOOP / NO SALTAR EL READ-GATE

Una señal no es conocimiento hasta que deja una traza.

El sistema conserva el orden porque cada etapa produce un objeto distinto. Buscar propone; leer verifica; revisar encuentra huecos; aprobar decide.

  1. 01Capturar

    Una señal entra con URL, fecha y origen.

  2. 02Leer

    El agente abre la fuente; buscar no cuenta como leer.

  3. 03Extraer evidencia

    Claims, cifras y localizadores quedan separados.

  4. 04Revisar

    El editor detecta huecos, límites y sobreinterpretaciones.

  5. 05Aprobar

    Luis decide qué se publica o qué vuelve a revisión.

  6. 06Publicar

    La versión aprobada se proyecta al radar y al MCP.

02STATE / WHAT THE SYSTEM KNOWS

La salud actual es visible antes de pedir más automatización.

PAPERS169en el archivo
LECTURAS COMPLETAS169/169con cuatro movimientos
REVISIÓN HUMANA167fichas con avisos
FIGURAS PRIMARIAS2registradas
03D1 LEDGER / EPHEMERAL AGENTS

La continuidad vive en la memoria, no en un agente oculto.

Las corridas se ejecutan en ChatGPT/Codex y terminan. D1 conserva lo que hace falta para retomarlas: tareas, runs, eventos, evidencia, relaciones y aprobaciones.

Abrir memoria
Entra con ChatGPT para abrir tu ledger privado.

Sin sesión, el sitio muestra sólo el contrato público; los agentes no se ejecutan aquí.

04ROSTER / SPECIALIZED AGENTS

Cada agente tiene una misión y un límite.

La especialización no busca repartir complejidad por estética; busca que una función no pueda saltarse la evidencia que otra debe comprobar.

PUBLICAR / 0 AGENTES
EN ESPERADescubrimiento

Scout

Encontrar señales candidatas sin confundir novedad con evidencia.

PRODUCEcandidatospreguntas de lecturaorigen de la señal
NO PUEDEdar un paper por leídopublicar
TRABAJANDOLectura y procedencia

Reader / Evidence

Convertir una fuente primaria en claims comprobables y localizadores concretos.

PRODUCEresultado reportadolocatorlímite de evidencia
NO PUEDEinferir mercadoalterar el paper
TRABAJANDORelaciones

Graph Curator

Proponer qué conecta, contradice o extiende una pieza del radar.

PRODUCErelaciones tipadasconfianzapreguntas de conexión
NO PUEDEconfirmar relaciones sin evidenciamodificar decisiones humanas
ESPERA HUMANACalidad editorial

Editor-agent

Detectar huecos y mejorar la ficha sin inventar evidencia.

PRODUCEreviewfindingsnext action
NO PUEDEpublicaraprobar en nombre de Luis
VERIFICADOEdición semanal

Weekly Synthesizer

Convertir piezas aprobadas en un corte que explique qué ha cambiado.

PRODUCEtesis semanaldelta de radarsiguientes movimientos
NO PUEDEpresentar hipótesis como resultadopublicar sin aprobación
EN ESPERASecond Brain

Memory Steward

Conservar sólo memoria que pueda cambiar una decisión posterior.

PRODUCEnota durablerelacióncaducidad o consolidación
NO PUEDEleer memoria sin identidadexponer notas privadas
VERIFICADORegresión y control

Evaluator

Comprobar que el sistema sigue siendo trazable, usable y publicable.

PRODUCEevidencia de QAregresionesestado de publicación
NO PUEDEarreglar silenciosamentedeclarar valor editorial
05CONTROL PLANE / DRY RUN

Una corrida completa, con la frontera de publicación visible.

Esta prueba recorre un paper real con especialistas acotados. Sirve para inspeccionar handoffs y excepciones antes de persistir ejecuciones o conectar modelos externos.

Entender el contrato MCP
RUN / dry-run:coevo-mem

CoEvo-Mem: Co-Evolving Retrieval Policy and Memory Bank for LLM Agents

ESPERA HUMANA
  1. 01
    ScoutCOMPLETADO

    Candidato aceptado para lectura primaria.

    https://arxiv.org/abs/2608.01739 está registrada como fuente canónica.
    reader-evidence
  2. 02
    Reader / EvidenceCOMPLETADO

    1 claim(s), 3 locator(s) y 2 límite(s) estructurados.

    Existe al menos un resultado reportado con locator.
    graph-curator
  3. 03
    Graph CuratorCOMPLETADO

    3 relación(es) con papers disponibles para explorar.

    vakra, ttt-embed, vibelifebench
    editor-agent
  4. 04
    Editor-agentCOMPLETADO

    needs-review · 97/100 · 1 hallazgo(s).

    Añadir una figura o tabla primaria cuando el permiso lo permita; si no, explicar la decisión y enlazar el original.
    human-publication-gate
  5. 05
    human-publication-gateESPERA HUMANA

    No publica automáticamente; espera una decisión humana ligada a esta versión.

    La frontera de publicación está definida en el contrato editorial y en MCP.
    published

GATE: La ejecución puede preparar y revisar; no puede aprobar ni desplegar contenido en tu nombre.

06WEEKLY RUN / 10–16 AGO 2026

La primera corrida ya deja una memoria retomable.

Este es el contrato de la edición semanal persistida en D1: el sitio no ejecuta agentes vivos; conserva el resultado, las decisiones y el punto exacto desde el que otro agente puede continuar.

weekly-research · COMPLETED / AUTO-AUTHORIZED
01 / scout-agentsource-discovery

Corte semanal procesado; source-pending conservado como señal.

completed
02 / reader-evidence-agentevidence-extraction

Claims de los 29 papers con localizadores y límites.

completed
03 / graph-curator-agentrelation-curation

Relaciones tipadas con confianza y claims de apoyo.

completed
04 / concept-agentconcept-detection

Conceptos multi-paper y multi-week listos para dossier.

completed
05 / editor-agenteditorial-review

Revisión editorial completa del corpus público.

completed
06 / publication-policy-agentapproval

Autorización automática trazada para esta corrida.

completed
07 / orchestratorpublication-result

Resultado publicado y versionado con el run.

completed
07QUEUE / EXCEPTIONS FIRST

La Mesa no oculta lo que aún necesita criterio.

La cola se ordena por excepción: primero los bloqueos, después los avisos y al final lo que ya puede continuar sin intervención.

Ver método
editor-agent167

Cola de revisión editorial

2 fichas listas, 167 con avisos y 0 bloqueadas sobre 169.

SIGUIENTE: Resolver los avisos empezando por resultados con localizadores exactos y recursos comprobables.
ESPERA HUMANA
reader-evidence167

Ledger de evidencia

157/169 fichas ya tienen un resultado reportado enlazado; 169 lecturas narrativas están completas y sólo 2 fichas tienen figura primaria registrada.

SIGUIENTE: Completar los resultados de las fichas restantes y añadir tabla/figura/página cuando la fuente lo permita.
TRABAJANDO
weekly-synthesizer11

Delta semanal del radar

11 cortes disponibles, 9 ejes y 169/169 señales clasificadas.

SIGUIENTE: Añadir el siguiente corte y explicar qué cambió, no sólo acumular puntos.
VERIFICADO
scout + reader-evidence0

Canonización del archivo histórico

169 señales importadas en 11 cortes; 169 apuntan a fichas públicas, 157 tienen lectura primaria completa y 12 esperan lectura editorial profunda. 0 esperan URL primaria verificable.

SIGUIENTE: Recuperar la fuente canónica de las entradas pendientes y sólo entonces promover sus claims al ledger de evidencia.
VERIFICADO
concept-agent16

Conceptos emergentes multi-paper

16 candidatos con soporte multi-paper; 16 reaparecen en al menos dos semanas y 0 necesitan ampliar fuente primaria.

SIGUIENTE: Abrir el dossier del concepto y comprobar si la coincidencia editorial se sostiene con claims, no sólo con alias.
VERIFICADO
evaluator12

Recursos reproducibles

12 fichas no declaran código, dataset o demo público; eso debe distinguirse de un fallo de la fuente.

SIGUIENTE: Registrar explícitamente 'no público' o añadir tipo, licencia y fecha de comprobación del recurso.
ESPERA HUMANA
Luis Eduardo

Puerta de publicación humana

No existe publicación automática en MCP; la fuente y el despliegue siguen siendo la frontera de aprobación.

SIGUIENTE: Aprobar una ficha sólo cuando su versión, evidencia y review estén ligadas al mismo estado.
ESPERA HUMANA

4 líneas necesitan una siguiente decisión. El sistema no las convierte en publicación automática.

08RUN LEDGER / VERIFIED CHECKS

Lo que se ha comprobado también forma parte de la memoria.

Estos registros estáticos muestran checks públicos del repositorio. Las corridas persistidas del usuario aparecen arriba cuando existe sesión y D1 disponible.

Abrir Second Brain
2026-08-17 · evaluator

Evaluación del Product Harness

200 findings, 20 áreas y 6 casos de evaluación pasados.

VERIFICADO
2026-08-17 · evaluator

Smoke test de MCP editorial

initialize, tools/list, contrato, paper:vakra, paper:coevo-mem y cola de 169 reviews.

VERIFICADO
2026-08-17 · weekly-synthesizer

Publicación del corte 03—09 AGO

15 papers, tesis semanal, señales, radar histórico y archivo navegable.

PUBLICADO
2026-08-17 · research-orchestrator

Corrida semanal 10–16 AGO 2026

9 artefactos durables: run, claims, relaciones, conceptos, review, aprobación y resultado.

PUBLICADO
THE HUMAN GATE

Más autonomía exige mejores pruebas, no menos responsabilidad.

Los agentes pueden preparar, trazar y dejar una aprobación pendiente. Luis decide qué se incorpora al sitio y qué despliegue sale a producción.

Leer la capa MCP Seguir la investigación