Mindwalk: Veja Todo o Seu Código-Fonte Como um Mapa 3D

BBetter Stack
컴퓨터/소프트웨어AI/미래기술

Transcript

00:00:00Há dois anos, estamos entregando nossos códigos para agentes de IA reescreverem
00:00:05o que bem entendem, e depois revisamos tudo apenas rolando uma parede de código.
00:00:09Alguém finalmente se cansou disso e criou o oposto: uma forma de realmente ver
00:00:14um agente navegando pelo seu código em 3D.
00:00:17Chama-se MindWalk.
00:00:18E isso pode ser uma forma ainda melhor de visualizar nosso código e dar vida a ele.
00:00:23Temos ferramentas como o Graphify, então como isso se compara?
00:00:30Aqui está o verdadeiro problema que o MindWalk tenta resolver.
00:00:34O log do nosso agente nos diz o que ele fez: executou isso, editou aquilo.
00:00:38O que ele nunca nos diz é como entendeu a tarefa.
00:00:41Quais arquivos ele decidiu que eram relevantes?
00:00:44Onde ele procurou antes de alterar uma única linha?
00:00:47Ele se manteve no foco ou percorreu silenciosamente metade do repositório?
00:00:51Tudo isso.
00:00:52O pensamento real do agente é meio invisível em uma transcrição.
00:00:55Simplesmente desaparece.
00:00:56Se você gosta de ferramentas de código para agilizar seu trabalho, inscreva-se no canal.
00:00:59Lançamos vídeos o tempo todo.
00:01:01Então, vou te mostrar como fica quando não desaparece.
00:01:04Tenho um projeto aqui em uma sessão do Claude Code que executei antes.
00:01:08Posso instalar isso, em Go, sem trocadilhos, e depois compilar.
00:01:14Agora posso iniciar o MindWalk com este comando aqui, e todo o meu código é renderizado como esta
00:01:20cidade escura em 3D.
00:01:21Cada arquivo é um prédio, e quanto mais código ele tem, mais alto ele é.
00:01:26Depois, dou o play na sessão.
00:01:29Observe as luzes aqui.
00:01:31Um arquivo brilha em verde, um verde-musgo, quando o agente apenas passa o olho por ele.
00:01:36Fica azul quando ele realmente para para ler, e âmbar quando faz uma edição.
00:01:41E posso arrastar a linha do tempo para frente e para trás e rastrear literalmente o caminho percorrido pelo agente por este
00:01:46código.
00:01:48É um único binário em Go que lê os logs da sessão que o Claude Code e o Codex já salvam
00:01:53no seu disco.
00:01:54Além de uma cena em Three.js no seu navegador para o 3D.
00:01:58Essa linguagem de cores é o grande truque aqui.
00:02:01Cores frias significam que o agente estava apenas observando.
00:02:03Cores quentes significam que ele estava alterando.
00:02:06A linha do tempo também é marcada.
00:02:07Pequenos símbolos mostram exatamente onde um subagente foi iniciado, onde a janela de contexto foi compactada,
00:02:14e onde você interrompeu com uma nova instrução.
00:02:17Assim, agora você sempre sabe para onde está indo.
00:02:20Mas aqui está a parte que eu realmente acho que importa.
00:02:22Depois de passar dessa fase do “ficou legal”, sabe?
00:02:24Existe um comando “analyze” que roda uma avaliação sobre toda a sessão usando seu próprio
00:02:29Claude ou Codex local, e ele dá uma nota para a execução recente.
00:02:33O agente explorou o suficiente antes de começar a editar?
00:02:37Certo, ele se manteve no escopo?
00:02:38Ele se dispersou?
00:02:40Ele se deu ao trabalho de verificar o próprio trabalho?
00:02:42E cada uma dessas descobertas é um link clicável direto para aquele momento na linha do tempo.
00:02:47Isso sim é uma revisão de código do agente.
00:02:49E se você não tiver replay de sessão, existe um comando “map” que renderiza qualquer repositório
00:02:54como uma cidade 3D diretamente, sem nenhuma configuração, o que é um recurso muito legal.
00:02:59Certo, agora vamos lá.
00:03:00Quando essa ferramenta foi lançada no Hacker News, o comentário principal foi bem sincero,
00:03:06porque você provavelmente também está se perguntando isso.
00:03:08Isso é muito legal, mas eu realmente usaria isso?
00:03:10Para que eu realmente usaria isso?
00:03:12E algumas pessoas nem discordaram disso.
00:03:14Elas disseram coisas como: “não serve para nenhum propósito prático”.
00:03:16É divertido, e nem tudo precisa de um motivo.
00:03:19Outra pessoa acabou fazendo uma crítica justa para pequenas alterações.
00:03:23Um simples git diff tradicional é muito mais rápido do que assistir a um agente neste tour 3D.
00:03:28Eu entendo.
00:03:29Então, isso é algo muito recente.
00:03:31Está na versão 0.3.
00:03:32Ele só lê logs do Claude Code e do Codex.
00:03:34Se você usa o Cursor, ainda não consegue reproduzir suas sessões.
00:03:38O que me leva à pergunta: para quem é isso de verdade?
00:03:41É só por diversão?
00:03:42Bem, se você está comparando modelos, quer ver como o Claude explora
00:03:45uma tarefa em comparação com o Codex.
00:03:48Esta é uma perspectiva muito legal que você não consegue em outro lugar.
00:03:51Se você está lidando com uma grande alteração feita por um agente, e um diff comum não está te dando
00:03:56a dimensão do que aconteceu, essa navegação 3D junto com o relatório de avaliação é bem bacana.
00:04:01Ela detalha tudo.
00:04:02Mas para uma correção de duas linhas, fala sério.
00:04:04Apenas leia o diff.
00:04:05Não acho que o MindWalk vá substituir nenhuma de nossas ferramentas de revisão.
00:04:09Mas ele está aqui, talvez, para te dar uma noção da execução que nossas ferramentas nunca foram criadas para
00:04:14realmente nos mostrar.
00:04:15E essa é a parte com a qual podemos realmente experimentar aqui.
00:04:19Ensinamos nossas máquinas a escrever nosso código muito mais rápido do que criamos formas de entender
00:04:24o que elas escreveram.
00:04:25O MindWalk, assim como o Graphify, Graphify, Graphify...
00:04:29Certo, acho que estou dizendo isso direito.
00:04:31Isso pode ser uma primeira tentativa séria de cobrir essa lacuna, permitindo que você veja como um agente realmente raciocina
00:04:36em toda a base de código, e não apenas no código final gerado por ele.
00:04:40É algo inicial, está no começo, mas foca exatamente no problema certo.
00:04:43Mas experimente e veja se isso te ajuda de alguma forma.
00:04:46Se você gosta de dicas e truques de programação como este, não deixe de se inscrever no canal da BetterStack.
00:04:50Nos vemos em outro vídeo.

Key Takeaway

O MindWalk visualiza o raciocínio e a navegação de agentes de IA em um repositório como uma cidade 3D interativa usando logs do Claude Code e Codex.

Highlights

  • O MindWalk renderiza o repositório como uma cidade 3D em que cada arquivo é um prédio com altura proporcional à quantidade de linhas de código.

  • A ferramenta utiliza um binário em Go para ler logs de sessão do Claude Code e Codex, combinando com Three.js para exibição no navegador.

  • Luzes e cores indicam as ações do agente: verde-musgo para verificação rápida, azul para leitura e âmbar para edições.

  • O comando “analyze” avalia a execução do agente e fornece links diretos para cada momento crítico na linha do tempo.

  • Na versão 0.3, a ferramenta lê apenas logs do Claude Code e Codex, sem suporte atual para sessões do Cursor.

Timeline

A visibilidade do raciocínio dos agentes de IA

  • Os logs tradicionais mostram apenas os arquivos editados e comandos executados.
  • O processo de tomada de decisão e a exploração do repositório permanecem invisíveis nas transcrições padrão.

A revisão de código gerado por IA geralmente se limita a rolar telas de alterações de texto. Falta clareza sobre como o agente compreendeu a tarefa, quais arquivos pesquisou ou se ele se desviou do escopo antes de alterar o código. O MindWalk surge como uma resposta visual para mapear essa trajetória de navegação.

Mapeamento 3D e código de cores na linha do tempo

  • A estrutura da base de código é convertida em um ambiente 3D onde edições e leituras possuem cores específicas.
  • A arquitetura do software combina um binário local em Go com renderização web via Three.js.

O sistema lê os logs de sessão do Claude Code ou Codex salvos no disco e gera a cena em um navegador. As cores frias indicam ações passivas, como passar o olho (verde) ou ler o arquivo (azul), enquanto a cor quente âmbar aponta edições diretas. A linha do tempo inclui marcas para eventos como subagentes, compactação da janela de contexto e interrupções do usuário.

Avaliação de sessões e visualização sem histórico

  • O comando “analyze” gera notas de execução com base no comportamento e escopo mantidos pelo agente.
  • O comando “map” permite renderizar qualquer repositório como uma cidade 3D sem depender de gravações de sessão.

A função de análise roda uma verificação local usando o modelo LLM do próprio ambiente. Esse relatório verifica se o agente explorou o código antes de editar, se manteve o foco na tarefa e se testou as próprias modificações, transformando cada crítica em um atalho para a linha do tempo. Para bases de código estáticas sem replay, o modo de mapa gera a visualização diretamente.

Casos de uso práticos e limitações do MindWalk

  • Diffs tradicionais em texto continuam sendo mais ágeis para ajustes simples de poucas linhas.
  • A renderização 3D agrega valor em grandes refatorações e na comparação direta do comportamento entre diferentes modelos de linguagem.

Atualmente na versão 0.3, a ferramenta não atende a quem utiliza o Cursor devido ao formato dos logs suportados. Para correções pontuais, o uso de um diff comum no terminal é superior em velocidade. No entanto, em alterações complexas e de grande escala, a combinação da navegação visual com o relatório de auditoria fornece contexto sobre como a máquina raciocinou no repositório.

Community Posts

View all posts