Mindwalk : Visualisez l'ensemble de votre base de code sous forme de carte 3D

BBetter Stack
컴퓨터/소프트웨어AI/미래기술

Transcript

00:00:00Pendant deux ans, on a confié nos bases de code à des agents IA en les laissant réécrire
00:00:05tout ce qu'ils voulaient, avant de revoir le résultat en faisant simplement défiler un mur de code.
00:00:09Quelqu'un a fini par en avoir assez et a créé exactement l'inverse : un moyen d'observer
00:00:14un agent se déplacer dans votre code en 3D.
00:00:17Ça s'appelle MindWalk.
00:00:18Et c'est peut-être même une meilleure façon de visualiser notre code et de lui donner vie.
00:00:23On a déjà des outils comme Graphify, alors comment se positionne celui-ci ?
00:00:30Voici le vrai problème auquel s'attaque MindWalk.
00:00:34Les journaux de notre agent nous disent ce qu'il a fait : exécuté ceci, édité cela.
00:00:38Ce qu'ils ne nous disent jamais, c'est comment il a compris la tâche.
00:00:41Quels fichiers a-t-il jugés pertinents ?
00:00:44Où est-il allé fouiller avant de modifier la moindre ligne ?
00:00:47S'est-il cantonné à son périmètre ou a-t-il parcouru discrètement la moitié du dépôt ?
00:00:51Tout cela.
00:00:52Le raisonnement réel de l'agent est plutôt invisible dans un historique.
00:00:55Il disparaît, tout simplement.
00:00:56Si vous aimez les outils de dev qui accélèrent votre workflow, abonnez-vous.
00:00:59Nous publions des vidéos en permanence.
00:01:01Laissez-moi donc vous montrer à quoi ça ressemble quand ça ne disparaît pas.
00:01:04J'ai ici un projet dans une session Claude Code exécutée plus tôt.
00:01:08Je peux l'installer via Go — sans jeu de mots — puis compiler le projet.
00:01:14Maintenant, je peux lancer MindWalk avec cette commande, et toute ma base de code est modélisée
00:01:20sous la forme d'une ville 3D sombre.
00:01:21Chaque fichier est un bâtiment, et plus il contient de code, plus il est haut.
00:01:26Ensuite, je clique sur lecture pour lancer la session.
00:01:29Regardez les lumières ici.
00:01:31Un fichier s'illumine en vert moussu lorsque l'agent ne fait que le survoler.
00:01:36En bleu lorsqu'il s'arrête pour le lire, et en ambre lorsqu'il y apporte une modification.
00:01:41Et je peux déplacer la ligne du temps d'avant en arrière pour suivre littéralement le chemin parcouru par l'agent
00:01:46dans ce code.
00:01:48C'est un simple binaire Go qui lit les logs de session que Claude Code et Codex écrivent déjà
00:01:53sur votre disque.
00:01:54Plus une scène Three.js dans votre navigateur pour la 3D.
00:01:58Ce code couleur est le vrai point fort.
00:02:01Les couleurs froides signifient que l'agent observait.
00:02:03Les couleurs chaudes signifient qu'il modifiait.
00:02:06La chronologie est aussi annotée.
00:02:07De petits symboles vous montrent exactement où un sous-agent a été démarré, où la fenêtre de contexte a été compactée,
00:02:14et où vous êtes intervenu avec une nouvelle instruction.
00:02:17Ainsi, vous savez toujours où vous allez.
00:02:20Mais voici l'élément qui me semble vraiment important.
00:02:22Une fois passé l'effet "C'est sympa
00:02:24Il existe une commande d'analyse qui évalue toute la session via votre propre instance locale
00:02:29de Claude ou Codex, et attribue une note à l'exécution qui vient de se terminer.
00:02:33L'agent a-t-il suffisamment exploré avant de commencer à éditer ?
00:02:37Est-il resté dans le périmètre demandé ?
00:02:38S'est-il éparpillé ?
00:02:40A-t-il pris la peine de vérifier son propre travail ?
00:02:42Et chacune de ces observations est un lien cliquable menant directement à ce moment sur la chronologie.
00:02:47C'est une véritable revue de code de l'agent.
00:02:49Et si vous n'avez aucun rejeu de session, une commande map permet de générer n'importe quel dépôt
00:02:54sous forme de ville 3D, de manière autonome et sans aucune configuration, ce qui est très pratique.
00:02:59D'accord, maintenant, c'est parti.
00:03:00Quand cet outil est sorti sur Hacker News, le commentaire le plus populaire était très honnête,
00:03:06parce que vous vous posez probablement la même question.
00:03:08C'est très cool, mais est-ce que je l'utiliserais vraiment ?
00:03:10À quoi cela me servirait-il concrètement ?
00:03:12Et certains n'ont même pas cherché à contredire cela.
00:03:14Ils ont dit des choses comme : ça ne sert à rien de précis.
00:03:16C'est amusant, et tout n'a pas besoin d'avoir une raison d'être.
00:03:19Quelqu'un d'autre a fini par porter une critique très juste concernant les petits changements.
00:03:23Un bon vieux git diff reste bien plus rapide que de regarder un agent faire cette visite 3D.
00:03:28Je comprends tout à fait.
00:03:29C'est encore un projet très récent.
00:03:31C'est la version 0.3.
00:03:32Il ne lit que les logs de Claude Code et Codex.
00:03:34Si vous utilisez Cursor, vous ne pouvez pas encore rejouer vos sessions.
00:03:38Ce qui m'amène à la question : à qui cela s'adresse-t-il vraiment ?
00:03:41Est-ce juste ludique ?
00:03:42Eh bien, si vous comparez des modèles et voulez voir comment Claude explore
00:03:45une tâche par rapport à Codex,
00:03:48c'est une perspective vraiment intéressante qu'on ne trouve nulle part ailleurs.
00:03:51Si vous faites face à une énorme modification réalisée par un agent et qu'un simple diff ne vous donne pas
00:03:56une vue d'ensemble claire, ce survol 3D combiné au rapport d'analyse est plutôt convaincant.
00:04:01Cela permet de bien décortiquer le tout.
00:04:02Mais pour une correction de deux lignes, soyons sérieux.
00:04:04Contentez-vous de lire un diff.
00:04:05Je ne pense pas que MindWalk va remplacer nos outils de revue actuels.
00:04:09Mais il est là, peut-être, pour donner une intuition du déroulement que nos outils n'ont jamais été conçus
00:04:14pour nous montrer.
00:04:15Et c'est précisément cet aspect que nous pouvons explorer ici.
00:04:19Nous avons appris à nos machines à écrire notre code bien plus vite que nous n'avons développé de moyens
00:04:24de comprendre ce qu'elles ont écrit.
00:04:25MindWalk, tout comme Graphify...
00:04:29Oui, je pense que je le prononce bien.
00:04:31Cela pourrait être une première tentative sérieuse pour combler ce fossé, en vous permettant de voir comment un agent raisonne
00:04:36à travers l'ensemble du code, et pas seulement les frappes de clavier qu'il a laissées derrière lui.
00:04:40C'est encore brut, c'est le début, mais ça s'attaque exactement au bon problème.
00:04:43Testez-le par vous-même et voyez si cela vous est utile.
00:04:46Si vous aimez ce genre de conseils et astuces de programmation, n'hésitez pas à vous abonner à la chaîne BetterStack.
00:04:50On se retrouve dans une prochaine vidéo.

Key Takeaway

MindWalk (version 0.3) permet de visualiser et d'évaluer l'exploration 3D ainsi que le raisonnement des agents IA dans une base de code à partir des logs de Claude Code ou Codex.

Highlights

  • MindWalk transforme une base de code en une ville 3D sombre où la hauteur de chaque bâtiment correspond au nombre de lignes du fichier.

  • L'outil s'appuie sur un binaire Go combiné à une scène Three.js et analyse les fichiers de logs générés par Claude Code et Codex.

  • Un code couleur dynamique indique l'activité de l'agent : vert pour le survol, bleu pour la lecture et ambre pour la modification.

  • Une commande d'analyse évalue le parcours de l'agent via un modèle LLM local pour noter son exploration, son respect du périmètre et ses vérifications.

  • Pour une modification mineure de deux lignes, la lecture classique d'un diff Git reste plus rapide et efficace que la visualisation 3D.

Timeline

Limites de la lecture classique des logs d'agents IA

  • Les journaux d'exécution textuels ne révèlent pas le processus d'assimilation de la tâche par l'agent IA.
  • Le parcours d'exploration et la portée réelle des fichiers consultés par l'agent restent invisibles dans un historique standard.

L'examen du code généré par IA s'effectue habituellement en faisant défiler des listes de modifications. Les logs d'exécution recensent les fichiers édités ou les commandes lancées, mais ne montrent pas l'itinérance initiale de l'agent avant ses modifications. Cette absence de visibilité masque la compréhension globale du projet par l'IA.

Fonctionnement technique et interface 3D de MindWalk

  • L'application utilise un binaire Go qui exploite les logs locaux de Claude Code et Codex conjointement avec Three.js dans le navigateur.
  • La base de code est représentée sous la forme d'une ville 3D où chaque bâtiment correspond à un fichier dont la hauteur reflète le volume de code.
  • Un système de couleurs chaudes et froides traduit les actions de survol, de lecture et d'édition au fil d'une chronologie interactive.

L'installation s'effectue par compilation d'un binaire Go qui extrait directement les données de session enregistrées sur le disque. L'interface affiche l'arborescence du projet sous forme de structures urbaines 3D. Le déplacement sur la ligne du temps met en évidence les fichiers observés en vert moussu, consultés en bleu ou modifiés en ambre, tout en annotant les démarrages de sous-agents ou les réinitialisations de contexte.

Analyse automatisée de session et génération de cartes

  • Une commande d'analyse utilise une instance locale de Claude ou Codex pour attribuer une note globale à la session de travail de l'agent.
  • Le rapport généré fournit des liens cliquables pour inspecter directement les moments critiques de l'intervention sur la chronologie.
  • La commande map produit une cartographie 3D de n'importe quel dépôt Git sans nécessiter de configuration préalable ou de rejeu.

L'outil dépasse la simple visualisation graphique en intégrant un module d'évaluation automatique de l'agent. Le modèle LLM local analyse si l'agent a suffisamment exploré le projet, respecté les limites fixées et contrôlé le code produit. Les éléments d'appréciation sont reliés à des horodatages précis du parcours 3D pour faciliter la revue.

Cas d'usage ciblés et limites de la version 0.3

  • La version 0.3 ne prend en charge que Claude Code et Codex, excluant l'historique des sessions issues de Cursor.
  • La visualisation 3D convient aux modifications massives et au suivi des modèles, tandis que le diff Git reste supérieur pour les corrections mineures.
  • L'outil vise à combler l'écart entre la rapidité de génération du code par l'IA et la capacité humaine à appréhender son raisonnement.

Les premiers retours d'utilisation soulignent l'inutilité de la visualisation 3D pour des corrections simples de deux lignes, où la comparaison textuelle Git demeure plus rapide. L'intérêt de MindWalk réside dans la comparaison des comportements entre différents modèles d'IA et dans la revue de modifications volumineuses. Il s'agit d'une première étape pour appréhender la trajectoire de réflexion globale d'un agent au sein du code.

Community Posts

View all posts