Mindwalk : Visualisez l'ensemble de votre base de code sous forme de carte 3D
BBetter Stack
컴퓨터/소프트웨어AI/미래기술
Transcript
00:00:00Pendant deux ans, on a confié nos bases de code à des agents IA en les laissant réécrire
00:00:05tout ce qu'ils voulaient, avant de revoir le résultat en faisant simplement défiler un mur de code.
00:00:09Quelqu'un a fini par en avoir assez et a créé exactement l'inverse : un moyen d'observer
00:00:14un agent se déplacer dans votre code en 3D.
00:00:17Ça s'appelle MindWalk.
00:00:18Et c'est peut-être même une meilleure façon de visualiser notre code et de lui donner vie.
00:00:23On a déjà des outils comme Graphify, alors comment se positionne celui-ci ?
00:00:30Voici le vrai problème auquel s'attaque MindWalk.
00:00:34Les journaux de notre agent nous disent ce qu'il a fait : exécuté ceci, édité cela.
00:00:38Ce qu'ils ne nous disent jamais, c'est comment il a compris la tâche.
00:00:41Quels fichiers a-t-il jugés pertinents ?
00:00:44Où est-il allé fouiller avant de modifier la moindre ligne ?
00:00:47S'est-il cantonné à son périmètre ou a-t-il parcouru discrètement la moitié du dépôt ?
00:00:51Tout cela.
00:00:52Le raisonnement réel de l'agent est plutôt invisible dans un historique.
00:00:55Il disparaît, tout simplement.
00:00:56Si vous aimez les outils de dev qui accélèrent votre workflow, abonnez-vous.
00:00:59Nous publions des vidéos en permanence.
00:01:01Laissez-moi donc vous montrer à quoi ça ressemble quand ça ne disparaît pas.
00:01:04J'ai ici un projet dans une session Claude Code exécutée plus tôt.
00:01:08Je peux l'installer via Go — sans jeu de mots — puis compiler le projet.
00:01:14Maintenant, je peux lancer MindWalk avec cette commande, et toute ma base de code est modélisée
00:01:20sous la forme d'une ville 3D sombre.
00:01:21Chaque fichier est un bâtiment, et plus il contient de code, plus il est haut.
00:01:26Ensuite, je clique sur lecture pour lancer la session.
00:01:29Regardez les lumières ici.
00:01:31Un fichier s'illumine en vert moussu lorsque l'agent ne fait que le survoler.
00:01:36En bleu lorsqu'il s'arrête pour le lire, et en ambre lorsqu'il y apporte une modification.
00:01:41Et je peux déplacer la ligne du temps d'avant en arrière pour suivre littéralement le chemin parcouru par l'agent
00:01:46dans ce code.
00:01:48C'est un simple binaire Go qui lit les logs de session que Claude Code et Codex écrivent déjà
00:01:53sur votre disque.
00:01:54Plus une scène Three.js dans votre navigateur pour la 3D.
00:01:58Ce code couleur est le vrai point fort.
00:02:01Les couleurs froides signifient que l'agent observait.
00:02:03Les couleurs chaudes signifient qu'il modifiait.
00:02:06La chronologie est aussi annotée.
00:02:07De petits symboles vous montrent exactement où un sous-agent a été démarré, où la fenêtre de contexte a été compactée,
00:02:14et où vous êtes intervenu avec une nouvelle instruction.
00:02:17Ainsi, vous savez toujours où vous allez.
00:02:20Mais voici l'élément qui me semble vraiment important.
00:02:22Une fois passé l'effet "C'est sympa
00:02:24Il existe une commande d'analyse qui évalue toute la session via votre propre instance locale
00:02:29de Claude ou Codex, et attribue une note à l'exécution qui vient de se terminer.
00:02:33L'agent a-t-il suffisamment exploré avant de commencer à éditer ?
00:02:37Est-il resté dans le périmètre demandé ?
00:02:38S'est-il éparpillé ?
00:02:40A-t-il pris la peine de vérifier son propre travail ?
00:02:42Et chacune de ces observations est un lien cliquable menant directement à ce moment sur la chronologie.
00:02:47C'est une véritable revue de code de l'agent.
00:02:49Et si vous n'avez aucun rejeu de session, une commande map permet de générer n'importe quel dépôt
00:02:54sous forme de ville 3D, de manière autonome et sans aucune configuration, ce qui est très pratique.
00:02:59D'accord, maintenant, c'est parti.
00:03:00Quand cet outil est sorti sur Hacker News, le commentaire le plus populaire était très honnête,
00:03:06parce que vous vous posez probablement la même question.
00:03:08C'est très cool, mais est-ce que je l'utiliserais vraiment ?
00:03:10À quoi cela me servirait-il concrètement ?
00:03:12Et certains n'ont même pas cherché à contredire cela.
00:03:14Ils ont dit des choses comme : ça ne sert à rien de précis.
00:03:16C'est amusant, et tout n'a pas besoin d'avoir une raison d'être.
00:03:19Quelqu'un d'autre a fini par porter une critique très juste concernant les petits changements.
00:03:23Un bon vieux git diff reste bien plus rapide que de regarder un agent faire cette visite 3D.
00:03:28Je comprends tout à fait.
00:03:29C'est encore un projet très récent.
00:03:31C'est la version 0.3.
00:03:32Il ne lit que les logs de Claude Code et Codex.
00:03:34Si vous utilisez Cursor, vous ne pouvez pas encore rejouer vos sessions.
00:03:38Ce qui m'amène à la question : à qui cela s'adresse-t-il vraiment ?
00:03:41Est-ce juste ludique ?
00:03:42Eh bien, si vous comparez des modèles et voulez voir comment Claude explore
00:03:45une tâche par rapport à Codex,
00:03:48c'est une perspective vraiment intéressante qu'on ne trouve nulle part ailleurs.
00:03:51Si vous faites face à une énorme modification réalisée par un agent et qu'un simple diff ne vous donne pas
00:03:56une vue d'ensemble claire, ce survol 3D combiné au rapport d'analyse est plutôt convaincant.
00:04:01Cela permet de bien décortiquer le tout.
00:04:02Mais pour une correction de deux lignes, soyons sérieux.
00:04:04Contentez-vous de lire un diff.
00:04:05Je ne pense pas que MindWalk va remplacer nos outils de revue actuels.
00:04:09Mais il est là, peut-être, pour donner une intuition du déroulement que nos outils n'ont jamais été conçus
00:04:14pour nous montrer.
00:04:15Et c'est précisément cet aspect que nous pouvons explorer ici.
00:04:19Nous avons appris à nos machines à écrire notre code bien plus vite que nous n'avons développé de moyens
00:04:24de comprendre ce qu'elles ont écrit.
00:04:25MindWalk, tout comme Graphify...
00:04:29Oui, je pense que je le prononce bien.
00:04:31Cela pourrait être une première tentative sérieuse pour combler ce fossé, en vous permettant de voir comment un agent raisonne
00:04:36à travers l'ensemble du code, et pas seulement les frappes de clavier qu'il a laissées derrière lui.
00:04:40C'est encore brut, c'est le début, mais ça s'attaque exactement au bon problème.
00:04:43Testez-le par vous-même et voyez si cela vous est utile.
00:04:46Si vous aimez ce genre de conseils et astuces de programmation, n'hésitez pas à vous abonner à la chaîne BetterStack.
00:04:50On se retrouve dans une prochaine vidéo.