证明 agent 干了啥?我交的那坨东西,连我自己都不信
· 阅读约 2 分钟
你有没有被叫去“证明一下你的 agent 跑完那轮到底干了什么”的时刻?
【灯光渐暗。一个程序员当场表演:大脑 OOM,手指开始翻终端日志。】
我那天干的事:翻日志,全选,复制,拼成一坨没有时间戳、没有操作者、任何人偷偷改一行都看不出痕迹的文本,交上去。
名义上是“证明”,实际上是一份我自己都不信、明天早上再看未必认得出的“证据”。
这算哪门子证据。
后来翻到一个叫 Halo 的小项目,直接给我整不会了。
它的逻辑几句话能说完:调用、访问、审批,全部串成一条哈希链,追加上去就改不动;谁要是动手脚,留一个检查点就能对出来。
但这都不是重点。重点是它默认了一件事——记录方不可信。
设计文档里写着:我们不信任生成记录的那一方。
我一看,乐了。这年头,有工具肯把“人会赖账”当成基本盘来设计,居然让我觉得踏实。
哈希链怎么算的?不讲了,公式 README 里躺着。今天想说的是另一件事。
这项目有份文档,有一句我反反复复看了三遍:
链和见证,都无法证明真实世界的所有操作都经过了记录器;捕获完整性取决于记录器装在哪,哈希机制管不了这个。
翻译成人话:你的 agent 要是在没装记录器的地方干了点啥,它也管不着。
一个专门做证据的工具,开口先承认自己证明不了全貌。AI 圈现在人人都在喊“全都记下来了”,就它在那里说“我只能告诉你链上发生了什么”——这个分寸,值钱。
我心里那杆秤,当场歪了一下。
还有两个模式,值得乐一乐。项目里接第三方的适配器,记录失败,活照干,账本回头补,fail open;官方自带的 trace 包装器,记录失败,直接停工,谁也别想动,fail closed。
同一个项目,两套哲学。你问哪种放心?我反正选后者。哪怕它耽误事,它起码不敢给你看一张“什么都没发生”的笑脸。
顺带一提,这项目星数少得可怜。但我反而多看了两眼——热门的东西忙着证明自己无所不能,它倒好,开篇先跟你交代它“有所不能”。
一个管自己叫“证据层”的工具,不给你出合格证,只负责让所有人都赖不掉。
这分寸感,刚刚好。
(友情提示:以后哪个产品跟你说“全量记录 AI 的一切行为”,不用急着信,先翻到它的 LIMITS.md,看它敢不敢承认自己证明不了全貌。🫠)
评论
还没有评论,写下第一条讨论。