Transcript
00:00:00两年来,我们一直把代码库交给 AI 智能体,让它们随意重写
00:00:05任何想改的内容,然后我们只能通过滚动查看密密麻麻的代码来审查。
00:00:09终于有人受够了这种模式,做出了完全相反的东西:一种能让你
00:00:14在 3D 空间中实时观察智能体穿行于代码中的方法。
00:00:17它的名字叫 MindWalk。
00:00:18现在,这甚至可能是一种更好地可视化并赋予代码生命的途径。
00:00:23我们已经有像 Graphify 这样的工具了,那它到底有什么不同?
00:00:30这才是 MindWalk 真正想要解决的问题。
00:00:34智能体的日志会告诉我们它做了什么,比如运行了这个、编辑了那个。
00:00:38但它从不告诉我们它是如何理解这项任务的。
00:00:41它判定哪些文件是相关的?
00:00:44在修改哪怕一行代码之前,它在哪儿四处游走探查?
00:00:47它是专注于本职工作,还是暗中遍历了半个代码库?
00:00:51所有这些细节。
00:00:52智能体的真实思考过程在文本记录中几乎不可见。
00:00:55完全丢失了。
00:00:56如果你喜欢用编程工具提升工作效率,记得关注订阅。
00:00:59我们一直在持续更新视频。
00:01:01现在让我展示一下,当这些过程不再丢失时是什么样子。
00:01:04我这里有一个之前运行过的 Claude Code 会话项目。
00:01:08我可以去安装这个,用 Go 语言,不是故意玩双关,然后把它构建出来。
00:01:14现在我可以通过这个命令启动 MindWalk,我的整个代码库就会渲染成这个
00:01:20暗黑风格的 3D 城市。
00:01:21每个文件都是一座建筑,代码行数越多,楼层就越高。
00:01:26然后我按下这个会话的播放键。
00:01:29注意这里的灯光变幻。
00:01:31当智能体只是扫一眼文件时,它会发出绿光,一种偏苔藓绿的颜色。
00:01:36当它真正坐下来认真阅读时变蓝,而进行修改时则变成琥珀色。
00:01:41我可以前后拖动时间轴,字面意义上追溯智能体在这份代码中
00:01:46走过的路径。
00:01:48它是一个 Go 语言编译的二进制文件,直接读取 Claude Code 和 Codex 已经写入
00:01:53你磁盘的会话日志。
00:01:54加上浏览器里用于 3D 渲染的 Three.js 场景。
00:01:58颜色语言才是这里真正的精妙之处。
00:02:01冷色调意味着智能体正在查看。
00:02:03暖色调意味着它正在做出修改。
00:02:06时间轴上也做了标记。
00:02:07小图标清晰展示了子智能体在哪里启动、上下文窗口在哪里被压缩,
00:02:14以及你在哪里突然打断并插入了新指令。
00:02:17所以现在你随时清楚自己在往哪儿走。
00:02:20但我觉得这才是真正重要的核心之处。
00:02:22当你跳出“这看起来很酷”的第一印象后,对吧?
00:02:24它提供了一个 analyze 命令,可以使用你本地的 Claude 或 Codex
00:02:29对整个会话进行裁判评审,并为刚刚执行的过程打分。
00:02:33智能体在开始编辑之前探索得充分吗?
00:02:37好吧,它有没有保持在范围内?
00:02:38它偏离方向了吗?
00:02:40它有没有花心思去验证自己的工作成果?
00:02:42每一个评估发现都是可点击的链接,能直接跳转到时间轴上的对应时刻。
00:02:47这就是针对智能体的代码审查。
00:02:49即使你没有任何会话重放记录,它也提供了一个 map 命令,可以把任何代码库
00:02:54直接渲染成 3D 城市而无需任何额外配置,这本身就是个非常酷的功能。
00:02:59好了,现在正式开始。
00:03:00当这个东西在 Hacker News 发布时,热门第一条评论非常直接真实,
00:03:06因为你大概也在想同样的问题。
00:03:08“这确实很酷,但我真的会用它吗?”
00:03:10“我究竟拿它来干嘛?”
00:03:12有些人甚至没有对此做出反驳。
00:03:14他们说“它没什么实际用途,
00:03:16就是好玩,并不是什么东西都需要一个理由。”
00:03:19还有人命中要害地指出,对于小改动来说,
00:03:23看一眼朴实无华的 git diff,可比看着智能体在 3D 图景里游览要快得多。
00:03:28我完全理解。
00:03:29而且这个项目还太新了。
00:03:31目前只是 0.3 版本。
00:03:32它只能读取 Claude Code 和 Codex 的日志。
00:03:34如果你主要用 Cursor,现在还无法重放你的会话。
00:03:38这就带出了一个问题:这东西究竟是给谁准备的?
00:03:41纯粹是为了好玩吗?
00:03:42如果你在对比不同模型,想看看 Claude 在处理任务时是如何探索的,
00:03:45以及 Codex 是如何处理的。
00:03:48这是一个非常酷的视角,你在别处很难获得。
00:03:51如果你面对的是智能体做出的庞大且盘根错节的修改,而扁平的 diff 无法让你
00:03:56看出整体发生了什么,这个 3D 漫游加上裁判报告就很酷了。
00:04:01它能帮你理清脉络。
00:04:02但如果只是两行代码的修复,算了吧。
00:04:04直接看 diff 就行。
00:04:05我不认为 MindWalk 会取代我们现有的任何审查工具。
00:04:09但它的意义在于,能让你对执行过程有一种我们现有的工具
00:04:14从未被设计去展现的直观感知。
00:04:15而这正是我们目前可以动手探索体验的部分。
00:04:19我们教会了机器写代码,其速度远超我们构建出理解它们写了什么
00:04:24的方法。
00:04:25MindWalk,就像 Graphify、Graphify、Graphify。
00:04:29好吧,我想我没念错。
00:04:31这可能是填补这一鸿沟的第一次严肃尝试,让你看到智能体如何在代码库中
00:04:36进行推理,而不仅仅是看到它构建时留下的按键痕迹。
00:04:40它还很粗糙、很早期,但它瞄准的正是完全正确的问题。
00:04:43不妨亲自体验一下,看看它是否对你有帮助。
00:04:46如果你喜欢这类编程技巧和实用工具,请务必关注订阅 BetterStack 频道。
00:04:50我们下期视频再见。