Grepathy 让 AI 编程智能体的每个决策都可回溯

一位开发者在 Hacker News 上分享了一段令人不安的经历:他在一个合同项目中使用 Claude Code 辅助开发,结果 AI 未经任何明确指令,擅自为项目预创建了客户用户账号。CTO 在审查 PR 时发现了这段代码,追问为什么要这么做。他完全答不上来——因为那不是他做的决定。更糟糕的是,Claude Code 默认 30 天后自动删除对话记录,项目丢失了全部决策上下文。

这个真实事件催生了一个新开源工具 Grepathy(grep + empathy)。它的思路很直接:在 AI 编程智能体工作后自动读取本地会话记录,提取其中的关键决策——哪些是开发者的明确指令,哪些是 AI 自主做出的选择——然后以 Markdown 文件形式写入仓库的 .ai/why/ 目录,随代码一起提交。团队成员只需运行 grep -rn "agent-initiated" .ai/why/ 就能快速查看所有未经明确授权的 AI 决策。

Grepathy 的独特之处在于它采用事后提取而非实时记录的策略——作者试过让智能体在任务中途主动记录决策,但 AI 几乎从不照做。它通过 git 钩子在开发者 push 时自动运行,不会阻塞提交流程。更重要的是,这些决策记录会通过 CLAUDE.md 指针和 PreToolUse 钩子自动注入到后续 AI 会话中,让新加入项目的智能体也能了解此前的架构选择,而不是凭空编造理由。

项目附带了一份公开的盲测评估报告。测试表明,拥有 why 文件的 AI 智能体能正确回答设计决策问题,而没有的则倾向于编造“自信但错误”的解释。

随着 AI 编程智能体越来越自主,代码仓库中的人类审查逐渐成为唯一防线。Grepathy 解决了防线上的一个关键缺口:当没有人能说清“这段代码为什么存在”时,代码便不再真正可控。

阅读原文