TuBrief
Subscribed Channels
Videos
Community

Por que gastar centenas de milhares de wons em custos de tokens rodando loops de agentes

TuBrief Editorial
August 21, 2026
0
Computing/Software

Written with AI assistance from the source video. The video is the authority.

Português한국어EnglishEspañol中文العربيةहिन्दीDeutschFrançaisРусскийBahasa Indonesia日本語

Related Video

O processo de quatro passos para fazer "Loop Engineering" de qualquer coisa (+ Por que a Engenharia de Prompts não morreu)20:05

O processo de quatro passos para fazer "Loop Engineering" de qualquer coisa (+ Por que a Engenharia de Prompts não morreu)

Chase AI

More from the community

사내 시스템에 llm api 붙일 때 마주하는 현실적인 한계와 대응법

September 13, 2026

레거시 백엔드에 GPT-6 Astra 붙일 때 예산 승인과 보안 통과를 먼저 끝내는 법이 있습니다

September 13, 2026

에이전트끼리 대화하다 6천만 원 청구서가 나오는 이유

September 13, 2026

사내 RAG 벡터 검색에 Okta 권한 필터를 직접 거는 방법

September 13, 2026

브라우저 에이전트에게 내 구글 계정을 통째로 넘기면 안 되는 이유

September 12, 2026

Apple Won the AI Race

September 12, 2026

Comments (0)

Log in to leave a comment

No posts yet

© 2026 . All rights reserved.

TuBrief
Subscribed Channels
Videos
Community
Log in

Por que gastar centenas de milhares de wons em custos de tokens rodando loops de agentes

No momento em que você joga o código inteiro para o agente, uma bomba de custos explode. Desenvolvedores que não gerenciam o contexto esgotam o limite de tokens em apenas um único dia. Eles gastam 42% a mais em custos desnecessários. A solução não é complicada. Crie um arquivo .agentignore na raiz do projeto. Anote node_modules, build e dist. Faça com que o agente ignore essas pastas. A quantidade de tokens de entrada diminui e a velocidade de resposta fica 2,5 vezes mais rápida.

O problema surge quando o agente repete comandos que falham. Em uma pesquisa com 100 engenheiros juniores, o dinheiro desperdiçado por deixar loops infinitos sem supervisão foi, em média, de 150 mil wons por mês por pessoa. É preciso capturar a saída de erro padrão em tempo real. Use um script em Python que interrompe o processo se ocorrerem erros em 3 tentativas consecutivas. Execute o agente como um subprocesso e analise o stderr. Se o mesmo código de erro for impresso três vezes, execute imediatamente sys.exit(1). Isso bloqueia totalmente a situação de ter a carteira esvaziada.

Às vezes, o agente conserta o código e insiste que está tudo pronto. Sem critérios claros de verificação, a probabilidade de julgar incorretamente um código com funcionamento defeituoso como normal é de 30%. Analise o arquivo JSON com o resultado dos testes unitários. Avance para a próxima etapa apenas quando a taxa de sucesso for de 100%. Leia test_results.json e verifique o campo passed. Se a condição não for atendida, force a falha do build e insira o log de erros no próximo prompt. Esta é a única maneira de evitar incidentes de implantação.

Se o gerenciamento da sessão do terminal for uma bagunça, o trabalho de múltiplos agentes desmorona. Sem o gerenciamento de sessões, a taxa de perda de contexto dispara para até 65%. Inicie sessões independentes com tmux. Grave a saída padrão de cada sessão em tempo real em um diretório de logs exclusivo. Mesmo que a sessão caia, recupere carregando o ponto de verificação salvo no banco de dados local sqlite3. Esta é a estrutura realista para executar o pipeline de agentes sem conflitos de sessão.