Mindwalk: Visualiza todo tu código como un mapa en 3D

BBetter Stack
Computing/SoftwareInternet Technology

Transcript

00:00:00Durante dos años, le hemos confiado nuestro código a agentes de IA para que reescriban
00:00:05lo que quieran, para luego revisarlo simplemente desplazándonos por un bloque de código infinito.
00:00:09Alguien por fin se hartó de eso y construyó todo lo contrario: una forma de ver
00:00:14cómo un agente se mueve por tu código en 3D.
00:00:17Se llama MindWalk.
00:00:18Incluso podría ser una mejor manera de visualizar nuestro código y darle vida.
00:00:23Tenemos herramientas como Graphify, así que ¿cómo se compara con ellas?
00:00:30Este es el problema real que MindWalk busca resolver.
00:00:34El registro del agente nos dice qué hizo: ejecutó esto, editó aquello.
00:00:38Lo que nunca nos dice es cómo entendió el trabajo.
00:00:41¿Qué archivos decidió que eran relevantes?
00:00:44¿Por dónde estuvo buscando antes de cambiar una sola línea?
00:00:47¿Se limitó a su área o recorrió discretamente medio repositorio?
00:00:51Todo eso.
00:00:52El pensamiento real del agente es casi invisible en un historial.
00:00:55Simplemente desaparece.
00:00:56Si te gustan las herramientas de programación para acelerar tu trabajo, suscríbete.
00:00:59Publicamos videos continuamente.
00:01:01Déjame mostrarte cómo se ve cuando no desaparece.
00:01:04Tengo un proyecto aquí en una sesión de Claude Code que ejecuté antes.
00:01:08Puedo instalarlo con Go y luego compilarlo.
00:01:14Ahora puedo iniciar MindWalk con este comando y todo mi código se rinde como esta
00:01:20ciudad oscura en 3D.
00:01:21Cada archivo es un edificio, y cuanto más código tiene, más alto es.
00:01:26Luego le doy a reproducir a la sesión.
00:01:29Miren las luces aquí.
00:01:31Un archivo brilla en verde, un verde musgo, cuando el agente solo lo echa un vistazo.
00:01:36Azul cuando se detiene a leerlo, y ámbar cuando hace una edición.
00:01:41Y puedo arrastrar la línea de tiempo hacia atrás y hacia adelante para seguir el camino del agente por
00:01:46este código.
00:01:48Es un solo binario de Go que lee los registros de sesión que Claude Code y Codex ya escriben
00:01:53en tu disco.
00:01:54Más una escena de Three.js en tu navegador para el 3D.
00:01:58Ese código de colores es el verdadero truco aquí.
00:02:01Los colores fríos significan que el agente estaba observando.
00:02:03Los colores cálidos significan que estaba haciendo cambios.
00:02:06La línea de tiempo también está marcada.
00:02:07Pequeños símbolos te muestran exactamente dónde se creó un subagente, dónde se compactó la ventana de contexto,
00:02:14y dónde interviniste con una nueva instrucción.
00:02:17Así que ahora siempre sabes hacia dónde vas.
00:02:20Pero aquí está la parte que realmente me parece importante.
00:02:22Una vez que superas el “se ve genial”, ¿verdad?
00:02:24Hay un comando de análisis que evalúa toda la sesión usando tu propio Claude
00:02:29o Codex local, y califica la ejecución que acaba de realizar.
00:02:33¿Exploró lo suficiente el agente antes de empezar a editar?
00:02:37¿Se mantuvo dentro del alcance?
00:02:38¿Se distrajo?
00:02:40¿Se molestó en verificar su propio trabajo?
00:02:42Y cada uno de esos hallazgos es un enlace directo a ese momento en la línea de tiempo.
00:02:47Eso es una revisión de código aplicada al agente.
00:02:49Y si no tienes ninguna reproducción de sesión, hay un comando “map” que renderiza cualquier repositorio
00:02:54como una ciudad 3D por sí solo y sin configuración, lo cual es un truco genial.
00:02:59Bien, vamos a lo siguiente.
00:03:00Cuando esto se lanzó en Hacker News, el comentario principal fue bastante honesto,
00:03:06porque probablemente tú también te lo estés preguntando.
00:03:08Esto está muy genial, ¿pero realmente lo usaría?
00:03:10¿Para qué lo usaría realmente?
00:03:12Y algunas personas ni siquiera discutieron eso.
00:03:14Dijeron cosas como “no sirve para nada real”.
00:03:16Es divertido, y no todo necesita una justificación.
00:03:19Alguien más dio una buena crítica respecto a los cambios pequeños.
00:03:23Un simple git diff tradicional es más rápido que ver al agente hacer este recorrido 3D.
00:03:28Lo entiendo.
00:03:29A ver, esto es extremadamente nuevo.
00:03:31Es la versión 0.3.
00:03:32Solo lee registros de Claude Code y Codex.
00:03:34Si usas Cursor, todavía no puedes reproducir tus sesiones.
00:03:38Lo que me lleva a la pregunta: ¿para quién es esto genuinamente?
00:03:41¿Es solo por diversión?
00:03:42Bueno, si estás comparando modelos y quieres ver cómo explora Claude
00:03:45una tarea en comparación con Codex,
00:03:48esta es una perspectiva genial que no obtienes en ningún otro lugar.
00:03:51Si estás analizando un cambio enorme realizado por un agente, y un diff plano no te da
00:03:56una visión clara de lo que pasó, este recorrido 3D junto con el informe de evaluación son excelentes.
00:04:01Te desglosa todo.
00:04:02Pero para una corrección de dos líneas, por favor,
00:04:04solo lee el diff.
00:04:05No creo que MindWalk vaya a reemplazar nuestras herramientas de revisión.
00:04:09Pero está aquí, tal vez, para darte una noción de la ejecución que nuestras herramientas nunca fueron diseñadas
00:04:14para mostrarnos.
00:04:15Y esa es la parte con la que podemos experimentar aquí.
00:04:19Le enseñamos a nuestras máquinas a escribir código mucho más rápido de lo que creamos formas de entender
00:04:24lo que escribieron.
00:04:25MindWalk, al igual que Graphify... Graphify...
00:04:29Bueno, creo que lo estoy diciendo bien.
00:04:31Este podría ser un primer intento serio para cerrar esa brecha, permitiéndote ver cómo razona un agente
00:04:36a través de la base de código, y no solo las teclas que presionó al construirla.
00:04:40Es experimental, está en fase temprana y apunta exactamente al problema correcto.
00:04:43Pruébalo y mira si te resulta útil.
00:04:46Si te gustan este tipo de consejos sobre programación, suscríbete al canal de BetterStack.
00:04:50Nos vemos en un próximo video.

Key Takeaway

MindWalk resuelve la invisibilidad del razonamiento de los agentes de IA convirtiendo sus registros de sesión de Claude Code y Codex en recorridos interactivos dentro de una ciudad 3D.

Highlights

  • MindWalk convierte repositorios de código en entornos 3D en el navegador usando Three.js y un único binario escrito en Go.

  • Cada archivo de código se representa como un edificio cuya altura depende de la cantidad total de líneas de código.

  • El sistema aplica un código de colores según el comportamiento del agente: verde musgo para exploración, azul para lectura y ámbar para modificaciones.

  • La herramienta incluye un comando de análisis local que evalúa si el agente exploró lo suficiente, mantuvo el alcance o verificó su propio trabajo.

  • El comando map renderiza cualquier repositorio completo como una ciudad 3D de forma directa y sin necesidad de configuración previa.

Timeline

Invisibilidad del razonamiento en los agentes de IA

  • Los registros tradicionales de los agentes de IA muestran qué cambios se ejecutaron pero ocultan el proceso de navegación del código.
  • El historial en texto plano borra la ruta de decisión sobre qué archivos se leyeron antes de modificar el repositorio.

Durante dos años la revisión de código generado por IA se redujo a desplazar bloques de texto infinitos. Las herramientas de registro convencionales registran únicamente la ejecución y edición de código. Este enfoque deja sin rastrear el alcance real de la búsqueda que realiza el agente por el proyecto antes de editar una sola línea.

Arquitectura y renderizado 3D con MindWalk

  • MindWalk funciona mediante un binario en Go combinado con Three.js para generar la escena 3D en el navegador.
  • La interfaz asigna colores específicos según la acción: verde musgo al verificar, azul al leer y ámbar al editar.
  • La línea de tiempo incluye marcas visuales para subagentes, compactación de ventana de contexto e instrucciones directas del usuario.

La herramienta toma los registros que Claude Code y Codex escriben en el disco local para representarlos gráficamente. La altura de los edificios equivale al volumen de código de cada archivo. El flujo de trabajo del agente se puede pausar, rebobinar y adelantar para rastrear exactamente qué zonas del proyecto observó o modificó.

Evaluación automatizada y mapeo de repositorios

  • El comando de análisis evalúa la sesión con modelos locales de Claude o Codex para calificar el desempeño del agente.
  • Cada hallazgo del informe de evaluación se enlaza directamente al segundo exacto en la línea de tiempo 3D.
  • El comando map genera la estructura completa de cualquier repositorio en 3D sin requerir archivos de configuración.

El análisis determina si el agente exploró lo suficiente antes de modificar código, si se mantuvo dentro del alcance asignado o si se distrajo durante el proceso. Esta función actúa como una revisión de código automatizada aplicada a la conducta del propio agente. En ausencia de registros de sesión previos, la visualización de la ciudad 3D sigue siendo funcional mediante el mapeo directo.

Limitaciones de la versión 0.3 y casos de uso prácticos

  • Un git diff convencional resulta más eficiente para correcciones simples de dos líneas de código.
  • La versión 0.3 de MindWalk limita la reproducción de sesiones exclusivamente a registros de Claude Code y Codex.
  • El recorrido 3D aporta valor principalmente en la comparación de modelos y en la inspección de reestructuraciones masivas de código.

Las revisiones de pocos cambios no justifican la reproducción en 3D respecto a la rapidez de una inspección git estándar. Entornos como Cursor aún no cuentan con soporte para reproducir sesiones en esta versión inicial. La utilidad real aparece al auditar cambios complejos en grandes repositorios y comparar el comportamiento de búsqueda entre distintos modelos de lenguaje.

Community Posts

View all posts