Mindwalk: смотрите на весь свой код как на 3D-карту

BBetter Stack
Computing/SoftwareInternet Technology

Transcript

00:00:00Два года мы доверили наши кодовые базы ИИ-агентам и позволили им переписывать
00:00:05всё, что им вздумается, а потом проверяли это, просто прокручивая бесконечные стены кода.
00:00:09Кому-то это наконец надоело, и он создал противоположное решение — способ наблюдать,
00:00:14как агент перемещается по вашему коду в 3D.
00:00:17Инструмент называется MindWalk.
00:00:18Возможно, это даже лучший способ визуализировать наш код и оживить его.
00:00:23У нас есть инструменты вроде Graphify, так с чем же это сравнить?
00:00:30Вот реальная проблема, на решение которой направлен MindWalk.
00:00:34Лог нашего агента показывает, что он сделал: запустил то, отредактировал это.
00:00:38Но он никогда не рассказывает, как именно он понял задачу.
00:00:41Какие файлы он посчитал релевантными?
00:00:44Где он искал информацию, прежде чем изменить хотя бы одну строчку?
00:00:47Остался ли он в своей области или тихо прошелся по половине репозитория?
00:00:51Всё это.
00:00:52Реальный ход мыслей агента в текстовом логе практически невиден.
00:00:55Его просто нет.
00:00:56Если вам нравятся инструменты для ускорения работы, подписывайтесь.
00:00:59Видео у нас выходят регулярно.
00:01:01Позвольте показать, как это выглядит, когда данные не теряются.
00:01:04У меня есть проект в сессии Claude Code, которую я запустил ранее.
00:01:08Я могу установить это, скомпилировать на Go и затем собрать проект.
00:01:14Теперь я запускаю MindWalk этой командой, и вся кодовая база рендерится как
00:01:20темный 3D-город.
00:01:21Каждый файл — это здание: чем больше в нем кода, тем оно выше.
00:01:26Затем я нажимаю воспроизведение сессии.
00:01:29Посмотрите на подсветку.
00:01:31Файл светится зеленым, мшисто-зеленым, когда агент просто мельком смотрит на него.
00:01:36Синим — когда он открывает и читает его, и янтарным — когда вносит изменения.
00:01:41И я могу перетаскивать временную шкалу и буквально отслеживать путь агента по
00:01:46этому коду.
00:01:48Это один исполняемый файл на Go, который читает логи сессий, пока Claude Code и Codex пишут
00:01:53их на ваш диск.
00:01:54Плюс сцена на Three.js в браузере для 3D-визуализации.
00:01:58Цветовая логика — главная фишка этой системы.
00:02:01Холодные цвета означают, что агент просматривал файлы.
00:02:03Теплые цвета — что он вносил изменения.
00:02:06Временная шкала тоже размечена.
00:02:07Значки показывают, где именно запустился под-агент, где сожмитесь окно контекста,
00:02:14и где вы вмешались с новым указанием.
00:02:17Так что теперь вы всегда знаете, к чему идете.
00:02:20Но вот деталь, которая действительно имеет значение.
00:02:22Когда прошел первый восторг от того, как это круто выглядит, да?
00:02:24Есть команда analyze, которая запускает оценку всей сессии с помощью вашего локального
00:02:29Claude или Codex, и выставляет оценку пройденному прогону.
00:02:33Достаточно ли агент изучил код перед правками?
00:02:37Оставался ли он в рамках задачи?
00:02:38Отвлекался ли он?
00:02:40Потрудился ли он проверить собственную работу?
00:02:42И каждое из этих наблюдений — это кликабельная ссылка прямо на нужный момент шкалы.
00:02:47Это полноценный код-ревью самого агента.
00:02:49А если у вас вообще нет записи сессии, команда map визуализирует любой репозиторий
00:02:54в виде 3D-города без какой-либо настройки, что само по себе очень крутая фишка.
00:02:59Итак, продолжим.
00:03:00Когда проект запустился на Hacker News, самый популярный комментарий был довольно честным,
00:03:06потому что вы наверняка задаетесь тем же вопросом.
00:03:08«Это очень круто, но стал бы я использовать это на практике?
00:03:10Для чего это вообще нужно?»
00:03:12И некоторые люди даже не стали спорить с этим.
00:03:14Они писали вещи вроде: «У этого нет реальной цели.
00:03:16Это просто весело, и не всему нужна причина».
00:03:19Кто-то в итоге сделал справедливое замечание насчет мелких правок.
00:03:23Обычный git diff просто быстрее, чем просмотр работы агента в 3D-туре.
00:03:28Я это понимаю.
00:03:29Так что проект пока очень свежий.
00:03:31Это версия 0.3.
00:03:32Она читает только логи Claude Code и Codex.
00:03:34Если вы работаете в Cursor, воспроизвести сессии пока не получится.
00:03:38И это подводит к вопросу: для кого это создано на самом деле?
00:03:41Это просто забава?
00:03:42Что ж, если вы сравниваете модели и хотите увидеть, как исследует Claude
00:03:45задачу по сравнению с Codex,
00:03:48то это отличный угол обзора, который мало где еще получишь.
00:03:51Если вы разбираете огромные изменения от агента, и обычный diff не дает вам
00:03:56понимания картины происшедшего, этот 3D-облет с отчетом оценки очень пригодится.
00:04:01Он раскладывает всё по полочкам.
00:04:02Но ради исправления двух строк, ну серьезно.
00:04:04Просто посмотрите diff.
00:04:05Не думаю, что MindWalk заменит привычные инструменты проверки.
00:04:09Но он создан для того, чтобы дать вам ощущение процесса прогона, которое старые инструменты
00:04:14просто не способны показать.
00:04:15И именно с этим мы можем здесь поэкспериментировать.
00:04:19Мы научили машины писать код гораздо быстрее, чем создали способы
00:04:24понять то, что они написали.
00:04:25MindWalk, как и Graphify...
00:04:29Кажется, я правильно произношу.
00:04:31Это может быть первой серьезной попыткой закрыть этот пробел — дать вам увидеть, как агент мыслит
00:04:36в масштабах кодовой базы, а не только нажатия клавиш при написании кода.
00:04:40Проект пока сырой и ранний, но он бьет ровно в правильную проблему.
00:04:43Попробуйте его в деле и посмотрите, полезен ли он вам.
00:04:46Если вам нравятся подобные советы и фишки по кодингу, подписывайтесь на канал BetterStack.
00:04:50Увидимся в следующем видео.

Key Takeaway

Инструмент MindWalk визуализирует работу ИИ-агентов в кодовой базе в виде 3D-города, позволяя отслеживать путь поиска решений и анализировать качество их работы.

Highlights

  • Текстовые логи ИИ-агентов скрывают контекст поиска, демонстрируя лишь итоговые запуски и редактирование файлов.

  • Инструмент MindWalk на Go и Three.js визиуализирует кодовую базу в виде 3D-города, где высота зданий зависит от объема кода.

  • Цветовая индикация MindWalk разделяет действия агента: зеленый — мельком просмотрен, синий — прочитан, янтарный — изменен.

  • Команда analyze запускает оценку логики агента через Claude или Codex с генерацией кликабельных ссылок на таймлайн сессии.

  • Версия MindWalk 0.3 поддерживает воспроизведение логов только для Claude Code и Codex, исключая Cursor.

Timeline

Проблема непрозрачности работы ИИ-агентов в коде

  • Текстовые логи не отражают логику принятия решений ИИ-агентами.
  • Бесконечная прокрутка кода замедляет проверку автоматических правок.

При использовании ИИ-агентов стандартные логи фиксируют только факты редактирования и запуска файлов. Процесс поиска информации, выбор релевантных модулей и глубина покрытия репозитория остаются скрытыми. MindWalk решает эту проблему за счет 3D-визуализации перемещений агента.

Принцип работы и визуальная логика MindWalk

  • MindWalk представляет кодовую базу как 3D-город, где размер зданий пропорционален объему кода.
  • Цветовая схема строго разграничивает просмотр и редактирование файлов.
  • Временная шкала фиксирует запуски под-агентов, сжатие контекста и вмешательство пользователя.

Утилита собрана на Go и использует Three.js для рендеринга сцены в браузере. Программа читает логи сессий Claude Code и Codex непосредственно с диска. Холодные цвета (зеленый и синий) обозначают просмотр и чтение, а теплый (янтарный) — внесение изменений в файл.

Анализ сессий и ограничение функциональности

  • Команда analyze проводит код-ревью действий самого агента.
  • Команда map строит 3D-карту репозитория без истории сессий.
  • MindWalk версии 0.3 не поддерживает сессии Cursor.

Встроенный анализ проверяет, достаточно ли агент изучил код перед правками и не отклонялся ли он от задачи. Замечания выводятся со ссылками на конкретные моменты временной шкалы. Для точечных правок из двух строк классический git diff остается быстрее и эффективнее.

Практическое применение 3D-карт кода

  • 3D-облет упрощает разбор масштабных автоматических изменений.
  • Инструмент позволяет сравнивать стратегии исследования кода между Claude и Codex.
  • Визуализация устраняет разрыв между скоростью генерации кода и скоростью его понимания человеком.

Скорость написания кода машинами превышает возможности человека по его быстрой интерпретации. MindWalk дает возможность оценить поведение агента в масштабе всей архитектуры. Инструмент наиболее полезен при сравнении моделей и проверке крупных рефакторингов.

Community Posts

View all posts