Por qué gastarás cientos de miles de wones en costos de tokens al ejecutar un bucle de agentes
En el momento en que metes todo el código al agente, explota una bomba de costos. Un desarrollador que no gestiona el contexto agota su límite de tokens en tan solo un día. Se gastan un 42 por ciento más de costos innecesarios. La solución no es complicada. Crea un archivo .agentignore en la raíz del proyecto. Anota node_modules, build y dist. Haz que el agente ignore estas carpetas. La cantidad de tokens de entrada disminuye y la velocidad de respuesta es 2.5 veces más rápida.
El problema surge cuando el agente repite comandos que fallan. En una encuesta a 100 ingenieros junior, el dinero perdido por dejar un bucle infinito sin supervisión promedió 150,000 wones al mes por persona. Es necesario capturar la salida de error estándar en tiempo real. Utiliza un script de Python que detenga el proceso si ocurren errores 3 veces seguidas. Ejecuta el agente como un subproceso y analiza stderr. Si el mismo código de error aparece tres veces, ejecuta inmediatamente sys.exit(1). Bloquea desde la raíz la situación en la que te vacíen la billetera.
A veces, el agente modifica el código e insiste en que ya está listo. Sin criterios de verificación claros, la probabilidad de juzgar como correcto un código que funciona mal es del 30 por ciento. Analiza el archivo JSON de los resultados de las pruebas unitarias. Pasa al siguiente paso solo cuando la tasa de éxito sea del 100 por ciento. Lee test_results.json y verifica el campo passed. Si las condiciones no coinciden, haz que la compilación falle e introduce el registro de errores en el siguiente aviso (prompt). Es la única forma de prevenir accidentes de implementación.
Si la gestión de la sesión de terminal es un desastre, el trabajo de múltiples agentes se viene abajo. Si no se gestiona la sesión, la tasa de pérdida de contexto se dispara hasta el 65 por ciento. Abre sesiones independientes con tmux. Inserta la salida estándar de cada sesión en tiempo real en un directorio de registros único. Incluso si la sesión muere, se recupera cargando el punto de control (checkpoint) guardado en la base de datos local sqlite3. Es una estructura realista para ejecutar canales de agentes sin conflictos de sesión.