Resultado, restricciones y verificación
El goal.md dice el resultado en una frase y lista criterios en el formato comando → salida esperada. Nada de "hasta que quede bien".
Área Ejecución Larga · agentes que trabajan horas y días
No es pedirle al agente que "trabaje 10 horas". Es darle un objetivo con prueba de listo, guardar el estado en archivos y poner topes. El agente trabaja en ciclos — Codex /goal, Claude Code /goal o un loop sin interfaz — y quien decide que terminó es la prueba, no él. Esta área reúne el método, el kit execucao-longa y todos los cursos y proyectos de INEMA sobre loops, contexto y memoria de agentes.
Guía del kit en PT, EN y ES. Probado en ejecuciones reales. Todo abierto.
01 · El método
Una sesión larga falla de tres maneras: el agente no sabe cuándo parar, olvida lo que ya hizo después de compactar o gasta lo que no debía. El método responde a cada una con una pieza.
El goal.md dice el resultado en una frase y lista criterios en el formato comando → salida esperada. Nada de "hasta que quede bien".
goal, plan, state, progress, failures y decisions.md guardan la tarea; canal.md guarda lo que la compactación pierde. Tras compactar o retomar, el agente relee los archivos.
Tiempo, tokens y memoria con tope. Créditos, API de pago, producción y acciones irreversibles se vuelven puerta humana: el agente se detiene y pregunta.
El agente elige la próxima acción útil, prueba, registra y sigue. Tres ciclos sin avance medible = detenerse y llamar al humano.
El mismo objetivo y el mismo historial a lo largo de horas.
Resume el historial antiguo para que quepa en la ventana. Cambia el prefijo y la caché cae justo después — es lo esperado.
Reaprovecha el prefijo idéntico. En sesión continua el acierto supera el 95%. Mide cached ÷ input.
02 · Cómo ejecutar
Instala una vez por máquina (reglas globales, hook de contexto y vigía). Después, cada objetivo largo tiene su propia carpeta de estado y sigue uno de los dos caminos.
Interactivo · tú acompañas
tools/novo-longrun.sh <proyecto> <slug> crea la carpeta con los siete archivos.goal.md con criterios nivel 3./goal en Codex o en Claude Code, con el prompt de templates/./goals, /goal pause|resume, /side.medir-sessao.py: duración, compactaciones, tokens y caché.Headless · corre solo
prompt.md y loop.env.tools/loop-longrun.sh <carpeta> — cada ciclo es un codex exec con tope de tiempo y memoria.# 1. carpeta de estado de la ejecución ~/projetos/execucao-longa/tools/novo-longrun.sh ~/projetos/mi-proyecto mi-objetivo # 2. goal.md: resultado + criterios "comando → salida esperada" # 3a. interactivo codex # → /goal con templates/prompt-goal-codex.md # 3b. headless ~/projetos/execucao-longa/tools/loop-longrun.sh mi-proyecto/longrun/2026-10-01-mi-objetivo # 4. cierra y mide python3 ~/projetos/execucao-longa/tools/medir-sessao.py <sesión.jsonl>
Detente e interviene si: pasan 3 ciclos sin avance medible; el agente repite "voy a terminar y hacer commit" sin terminar, o reabre lo que ya estaba hecho; o llega a la 3.ª compactación en la misma sesión — entonces es handoff y sesión nueva.
03 · Criterio de listo
En ejecución larga, el mínimo es el nivel 3. Por debajo, el agente se autoaprueba o cumple la letra sin hacer el trabajo.
tests/ intacto". Mínimo aceptado./goal en Claude solo lee la conversación)? ¿Cubre función, regresión y límite?04 · Contexto y memoria
/goal lo que se deteriora. Es la compactación repetida.El objetivo sobrevive a la compactación, pero el "qué ya está hecho / qué falta" se pierde: el agente reabre trabajo y no converge. El kit lo trata antes del límite automático.
~50% → anotar en canal.md. ~70% → actualizar el estado y /compact. ~85% o 3.ª compactación → /session-handoff, sesión nueva y /prime. Un hook de Claude Code avisa una vez por franja.
Si el orquestador duerme entre ciclos: OpenAI ~30 min (despertar cada ~25), Claude 1 h (~55). Perder la caché cuesta de 12,5x a 25x.
Una tarea por archivo, cerrar solo con evidencia, como máximo 5 tareas creadas por el agente. Cola vacía → registrar y parar.
recall "término"Índice SQLite FTS5 de todo lo dicho con Codex y Claude, reindexado cada hora — 90 mil fragmentos, búsqueda en centésimas de segundo.
tools/vigia.py cada 10 min (timer de systemd): ejecución detenida, parada sin aviso u ociosa.
medir-sessao.pyLee 1,8 GB de sesión en ~9 s: duración, compactaciones, tokens, caché y salida de herramientas, por turno.
05 · Áreas relacionadas
Ciclos de mejora en IA: el loop que aprende con evidencia.
Abrir el área → ÁreaMeta con condición de parada, handoff y prime — uno hace, el otro verifica.
Abrir el área → ÁreaComandar agentes que trabajan solos.
Abrir el área → ÁreaGestionar agentes: delegar, limitar y supervisar.
Abrir el área →06 · Proyectos y cursos
Método, plantillas, loop headless, hook de contexto, vigía, medición de sesiones y recall.
Statusline con cuota real, checkpoint, auditoría de memoria y handoff antes del /clear.
Núcleo portátil y handoff entre sesiones y agentes.
Abrir la guía → FrameworkLoops que se automejoran: evidencia, hipótesis, experimento, promoción y vuelta atrás.
Abrir la guía →Sistemas con IA en el loop.
Abrir el curso → CursoIngeniería de loops.
Abrir el curso → CursoDe loops a grafos de agentes.
Abrir el curso → CursoLa empresa que aprende sola.
Abrir el curso → CursoDominar contexto y tokens.
Abrir el curso → CursoCaché de prompts en Claude Code.
Abrir el curso → CursoInyección de memoria vía hooks.
Abrir el curso → CursoFormación en ingeniería de contexto.
Abrir el curso → CursoUno hace, el otro verifica.
Abrir el curso → CursoDelegar, verificar, iterar y escalar con Codex.
Abrir el curso → CursoDesarrollo con agentes: planes, pruebas y verificación.
Abrir el curso →07 · Empieza ahora
Elige una tarea que una prueba pueda demostrar, crea la carpeta con novo-longrun.sh, escribe el goal.md y corre un ciclo. Después mide la sesión.
Plantillas, loop headless, hook de contexto, vigía, medición y recall.
Sesiones de Claude Code ligeras: cuota real, checkpoint y handoff.
Abrir la guía →Uno planifica, el otro desafía — y la meta con condición de parada.
Abrir el área →¿Dudas sobre por dónde empezar? Habla con nosotros en Telegram.