行业动态Simon Willison01:47
引用Boris Cherny的话
Quoting Boris Cherny
Boris Cherny观点引述,适合判断行业风向,但无数据难验证。
判断
这句话改变的是用 Claude 写生产代码的团队负责人:Boris Cherny 把「Claude 写的代码门槛要高于人写」当成 Anthropic 的前提,那么护栏没配齐的团队,等于还在用人写代码的旧标准给 Claude 的产出放行。
依据
Boris Cherny 在 Anthropic 的立场是:Claude 写出的生产代码,验收标准应当高于人类写出的同等代码。他没有给数字,只列出 Anthropic 用来兜住这条线的机制——大量 lint 规则(lint 是检查代码风格与可疑写法的静态规则)、大量测试、由 Claude 驱动的端到端测试(从入口跑到出口的完整链路测试)、每天运行的 Claude 模糊测试器(fuzzers,用随机输入去撞崩溃)、自动化代码审查与安全审查、自动化代码重构。机制上这是把质量成本从「上线后修 bug」搬到「合并前拦截」:门槛抬在人类代码之上,代价是流水线更长、每个改动要过更多关卡;而这些关卡缺位时,他给出的结果是留下难以长期维护的烂摊子。可对照的只有他列举的这套 Anthropic 自有防线,材料没有给出任何一条外部基准。
没写清 材料没给这条「更高门槛」的任何结果指标:回归缺陷率、审查耗时、拦截比例都没有,也没有不配护栏的团队实际付出的代价。
下一步 下一步看 Simon Willison 该条目或其后续文章是否补上 Anthropic 护栏清单或任一项量化结果,以及 Cherny 本人是否公开给出数字。