Transcript
00:00:00Há dois anos, estamos entregando nossos códigos para agentes de IA reescreverem
00:00:05o que bem entendem, e depois revisamos tudo apenas rolando uma parede de código.
00:00:09Alguém finalmente se cansou disso e criou o oposto: uma forma de realmente ver
00:00:14um agente navegando pelo seu código em 3D.
00:00:17Chama-se MindWalk.
00:00:18E isso pode ser uma forma ainda melhor de visualizar nosso código e dar vida a ele.
00:00:23Temos ferramentas como o Graphify, então como isso se compara?
00:00:30Aqui está o verdadeiro problema que o MindWalk tenta resolver.
00:00:34O log do nosso agente nos diz o que ele fez: executou isso, editou aquilo.
00:00:38O que ele nunca nos diz é como entendeu a tarefa.
00:00:41Quais arquivos ele decidiu que eram relevantes?
00:00:44Onde ele procurou antes de alterar uma única linha?
00:00:47Ele se manteve no foco ou percorreu silenciosamente metade do repositório?
00:00:51Tudo isso.
00:00:52O pensamento real do agente é meio invisível em uma transcrição.
00:00:55Simplesmente desaparece.
00:00:56Se você gosta de ferramentas de código para agilizar seu trabalho, inscreva-se no canal.
00:00:59Lançamos vídeos o tempo todo.
00:01:01Então, vou te mostrar como fica quando não desaparece.
00:01:04Tenho um projeto aqui em uma sessão do Claude Code que executei antes.
00:01:08Posso instalar isso, em Go, sem trocadilhos, e depois compilar.
00:01:14Agora posso iniciar o MindWalk com este comando aqui, e todo o meu código é renderizado como esta
00:01:20cidade escura em 3D.
00:01:21Cada arquivo é um prédio, e quanto mais código ele tem, mais alto ele é.
00:01:26Depois, dou o play na sessão.
00:01:29Observe as luzes aqui.
00:01:31Um arquivo brilha em verde, um verde-musgo, quando o agente apenas passa o olho por ele.
00:01:36Fica azul quando ele realmente para para ler, e âmbar quando faz uma edição.
00:01:41E posso arrastar a linha do tempo para frente e para trás e rastrear literalmente o caminho percorrido pelo agente por este
00:01:46código.
00:01:48É um único binário em Go que lê os logs da sessão que o Claude Code e o Codex já salvam
00:01:53no seu disco.
00:01:54Além de uma cena em Three.js no seu navegador para o 3D.
00:01:58Essa linguagem de cores é o grande truque aqui.
00:02:01Cores frias significam que o agente estava apenas observando.
00:02:03Cores quentes significam que ele estava alterando.
00:02:06A linha do tempo também é marcada.
00:02:07Pequenos símbolos mostram exatamente onde um subagente foi iniciado, onde a janela de contexto foi compactada,
00:02:14e onde você interrompeu com uma nova instrução.
00:02:17Assim, agora você sempre sabe para onde está indo.
00:02:20Mas aqui está a parte que eu realmente acho que importa.
00:02:22Depois de passar dessa fase do “ficou legal”, sabe?
00:02:24Existe um comando “analyze” que roda uma avaliação sobre toda a sessão usando seu próprio
00:02:29Claude ou Codex local, e ele dá uma nota para a execução recente.
00:02:33O agente explorou o suficiente antes de começar a editar?
00:02:37Certo, ele se manteve no escopo?
00:02:38Ele se dispersou?
00:02:40Ele se deu ao trabalho de verificar o próprio trabalho?
00:02:42E cada uma dessas descobertas é um link clicável direto para aquele momento na linha do tempo.
00:02:47Isso sim é uma revisão de código do agente.
00:02:49E se você não tiver replay de sessão, existe um comando “map” que renderiza qualquer repositório
00:02:54como uma cidade 3D diretamente, sem nenhuma configuração, o que é um recurso muito legal.
00:02:59Certo, agora vamos lá.
00:03:00Quando essa ferramenta foi lançada no Hacker News, o comentário principal foi bem sincero,
00:03:06porque você provavelmente também está se perguntando isso.
00:03:08Isso é muito legal, mas eu realmente usaria isso?
00:03:10Para que eu realmente usaria isso?
00:03:12E algumas pessoas nem discordaram disso.
00:03:14Elas disseram coisas como: “não serve para nenhum propósito prático”.
00:03:16É divertido, e nem tudo precisa de um motivo.
00:03:19Outra pessoa acabou fazendo uma crítica justa para pequenas alterações.
00:03:23Um simples git diff tradicional é muito mais rápido do que assistir a um agente neste tour 3D.
00:03:28Eu entendo.
00:03:29Então, isso é algo muito recente.
00:03:31Está na versão 0.3.
00:03:32Ele só lê logs do Claude Code e do Codex.
00:03:34Se você usa o Cursor, ainda não consegue reproduzir suas sessões.
00:03:38O que me leva à pergunta: para quem é isso de verdade?
00:03:41É só por diversão?
00:03:42Bem, se você está comparando modelos, quer ver como o Claude explora
00:03:45uma tarefa em comparação com o Codex.
00:03:48Esta é uma perspectiva muito legal que você não consegue em outro lugar.
00:03:51Se você está lidando com uma grande alteração feita por um agente, e um diff comum não está te dando
00:03:56a dimensão do que aconteceu, essa navegação 3D junto com o relatório de avaliação é bem bacana.
00:04:01Ela detalha tudo.
00:04:02Mas para uma correção de duas linhas, fala sério.
00:04:04Apenas leia o diff.
00:04:05Não acho que o MindWalk vá substituir nenhuma de nossas ferramentas de revisão.
00:04:09Mas ele está aqui, talvez, para te dar uma noção da execução que nossas ferramentas nunca foram criadas para
00:04:14realmente nos mostrar.
00:04:15E essa é a parte com a qual podemos realmente experimentar aqui.
00:04:19Ensinamos nossas máquinas a escrever nosso código muito mais rápido do que criamos formas de entender
00:04:24o que elas escreveram.
00:04:25O MindWalk, assim como o Graphify, Graphify, Graphify...
00:04:29Certo, acho que estou dizendo isso direito.
00:04:31Isso pode ser uma primeira tentativa séria de cobrir essa lacuna, permitindo que você veja como um agente realmente raciocina
00:04:36em toda a base de código, e não apenas no código final gerado por ele.
00:04:40É algo inicial, está no começo, mas foca exatamente no problema certo.
00:04:43Mas experimente e veja se isso te ajuda de alguma forma.
00:04:46Se você gosta de dicas e truques de programação como este, não deixe de se inscrever no canal da BetterStack.
00:04:50Nos vemos em outro vídeo.