Transcript
00:00:00Два года мы доверили наши кодовые базы ИИ-агентам и позволили им переписывать
00:00:05всё, что им вздумается, а потом проверяли это, просто прокручивая бесконечные стены кода.
00:00:09Кому-то это наконец надоело, и он создал противоположное решение — способ наблюдать,
00:00:14как агент перемещается по вашему коду в 3D.
00:00:17Инструмент называется MindWalk.
00:00:18Возможно, это даже лучший способ визуализировать наш код и оживить его.
00:00:23У нас есть инструменты вроде Graphify, так с чем же это сравнить?
00:00:30Вот реальная проблема, на решение которой направлен MindWalk.
00:00:34Лог нашего агента показывает, что он сделал: запустил то, отредактировал это.
00:00:38Но он никогда не рассказывает, как именно он понял задачу.
00:00:41Какие файлы он посчитал релевантными?
00:00:44Где он искал информацию, прежде чем изменить хотя бы одну строчку?
00:00:47Остался ли он в своей области или тихо прошелся по половине репозитория?
00:00:51Всё это.
00:00:52Реальный ход мыслей агента в текстовом логе практически невиден.
00:00:55Его просто нет.
00:00:56Если вам нравятся инструменты для ускорения работы, подписывайтесь.
00:00:59Видео у нас выходят регулярно.
00:01:01Позвольте показать, как это выглядит, когда данные не теряются.
00:01:04У меня есть проект в сессии Claude Code, которую я запустил ранее.
00:01:08Я могу установить это, скомпилировать на Go и затем собрать проект.
00:01:14Теперь я запускаю MindWalk этой командой, и вся кодовая база рендерится как
00:01:20темный 3D-город.
00:01:21Каждый файл — это здание: чем больше в нем кода, тем оно выше.
00:01:26Затем я нажимаю воспроизведение сессии.
00:01:29Посмотрите на подсветку.
00:01:31Файл светится зеленым, мшисто-зеленым, когда агент просто мельком смотрит на него.
00:01:36Синим — когда он открывает и читает его, и янтарным — когда вносит изменения.
00:01:41И я могу перетаскивать временную шкалу и буквально отслеживать путь агента по
00:01:46этому коду.
00:01:48Это один исполняемый файл на Go, который читает логи сессий, пока Claude Code и Codex пишут
00:01:53их на ваш диск.
00:01:54Плюс сцена на Three.js в браузере для 3D-визуализации.
00:01:58Цветовая логика — главная фишка этой системы.
00:02:01Холодные цвета означают, что агент просматривал файлы.
00:02:03Теплые цвета — что он вносил изменения.
00:02:06Временная шкала тоже размечена.
00:02:07Значки показывают, где именно запустился под-агент, где сожмитесь окно контекста,
00:02:14и где вы вмешались с новым указанием.
00:02:17Так что теперь вы всегда знаете, к чему идете.
00:02:20Но вот деталь, которая действительно имеет значение.
00:02:22Когда прошел первый восторг от того, как это круто выглядит, да?
00:02:24Есть команда analyze, которая запускает оценку всей сессии с помощью вашего локального
00:02:29Claude или Codex, и выставляет оценку пройденному прогону.
00:02:33Достаточно ли агент изучил код перед правками?
00:02:37Оставался ли он в рамках задачи?
00:02:38Отвлекался ли он?
00:02:40Потрудился ли он проверить собственную работу?
00:02:42И каждое из этих наблюдений — это кликабельная ссылка прямо на нужный момент шкалы.
00:02:47Это полноценный код-ревью самого агента.
00:02:49А если у вас вообще нет записи сессии, команда map визуализирует любой репозиторий
00:02:54в виде 3D-города без какой-либо настройки, что само по себе очень крутая фишка.
00:02:59Итак, продолжим.
00:03:00Когда проект запустился на Hacker News, самый популярный комментарий был довольно честным,
00:03:06потому что вы наверняка задаетесь тем же вопросом.
00:03:08«Это очень круто, но стал бы я использовать это на практике?
00:03:10Для чего это вообще нужно?»
00:03:12И некоторые люди даже не стали спорить с этим.
00:03:14Они писали вещи вроде: «У этого нет реальной цели.
00:03:16Это просто весело, и не всему нужна причина».
00:03:19Кто-то в итоге сделал справедливое замечание насчет мелких правок.
00:03:23Обычный git diff просто быстрее, чем просмотр работы агента в 3D-туре.
00:03:28Я это понимаю.
00:03:29Так что проект пока очень свежий.
00:03:31Это версия 0.3.
00:03:32Она читает только логи Claude Code и Codex.
00:03:34Если вы работаете в Cursor, воспроизвести сессии пока не получится.
00:03:38И это подводит к вопросу: для кого это создано на самом деле?
00:03:41Это просто забава?
00:03:42Что ж, если вы сравниваете модели и хотите увидеть, как исследует Claude
00:03:45задачу по сравнению с Codex,
00:03:48то это отличный угол обзора, который мало где еще получишь.
00:03:51Если вы разбираете огромные изменения от агента, и обычный diff не дает вам
00:03:56понимания картины происшедшего, этот 3D-облет с отчетом оценки очень пригодится.
00:04:01Он раскладывает всё по полочкам.
00:04:02Но ради исправления двух строк, ну серьезно.
00:04:04Просто посмотрите diff.
00:04:05Не думаю, что MindWalk заменит привычные инструменты проверки.
00:04:09Но он создан для того, чтобы дать вам ощущение процесса прогона, которое старые инструменты
00:04:14просто не способны показать.
00:04:15И именно с этим мы можем здесь поэкспериментировать.
00:04:19Мы научили машины писать код гораздо быстрее, чем создали способы
00:04:24понять то, что они написали.
00:04:25MindWalk, как и Graphify...
00:04:29Кажется, я правильно произношу.
00:04:31Это может быть первой серьезной попыткой закрыть этот пробел — дать вам увидеть, как агент мыслит
00:04:36в масштабах кодовой базы, а не только нажатия клавиш при написании кода.
00:04:40Проект пока сырой и ранний, но он бьет ровно в правильную проблему.
00:04:43Попробуйте его в деле и посмотрите, полезен ли он вам.
00:04:46Если вам нравятся подобные советы и фишки по кодингу, подписывайтесь на канал BetterStack.
00:04:50Увидимся в следующем видео.