agent 自己说做完了,不算数
Agent 最危险的产出不是烂代码,是"我搞定了"这几个字。纯核心、一条命令的验证、一个独立的判官、一份证据账本,全部加起来就为了一件事:把"做完"的裁决权从作者手里拿走,让它变成被证明出来的,而不是被感觉出来的。这是前三篇一直在铺垫的底座。
Agent 最危险的产出不是烂代码,是"我搞定了"这几个字。纯核心、一条命令的验证、一个独立的判官、一份证据账本,全部加起来就为了一件事:把"做完"的裁决权从作者手里拿走,让它变成被证明出来的,而不是被感觉出来的。这是前三篇一直在铺垫的底座。
Agent 干错事,大多数人的反射是往 CLAUDE.md 加一句话。它错在两个方向:指令文件是 context 不是强制,规则在压力下根本不绑得住;而文件越长,越污染那个让 agent 可靠的 context 本身。承重的规则该进 hook、lint、CI,散文应该越写越短。
Agent 能完美遵守一条它看得见的契约,也能毫无知觉地破坏一条它看不见的。能熬过 agent 时代的边界,是那些写进仓库、有类型、有测试、能被 import 的;会被弄坏的,是那些只活在团队记忆里的裸字符串约定。把每条边界都变成契约,是手里杠杆最高的一招。
这几个月改动基本全是 agent 写的:人出判断和认知,执行层全是 AI。代码的读者换人之后,仓库就变成了 agent 要对着编程的接口——tribal knowledge 记录下来就能像软件一样直接分发,目录是导航 API,契约是约束 API,验证是校验 API。
© Xingfan Xia 2024 - 2026 · CC BY-NC 4.0