跳到正文

行业动态Simon Willison01:47

引用Boris Cherny的话

Quoting Boris Cherny

Boris Cherny观点引述,适合判断行业风向,但无数据难验证。

判断

这句话改变的是用 Claude 写生产代码的团队负责人:Boris Cherny 把「Claude 写的代码门槛要高于人写」当成 Anthropic 的前提,那么护栏没配齐的团队,等于还在用人写代码的旧标准给 Claude 的产出放行。

依据

Boris Cherny 在 Anthropic 的立场是:Claude 写出的生产代码,验收标准应当高于人类写出的同等代码。他没有给数字,只列出 Anthropic 用来兜住这条线的机制——大量 lint 规则(lint 是检查代码风格与可疑写法的静态规则)、大量测试、由 Claude 驱动的端到端测试(从入口跑到出口的完整链路测试)、每天运行的 Claude 模糊测试器(fuzzers,用随机输入去撞崩溃)、自动化代码审查与安全审查、自动化代码重构。机制上这是把质量成本从「上线后修 bug」搬到「合并前拦截」:门槛抬在人类代码之上,代价是流水线更长、每个改动要过更多关卡;而这些关卡缺位时,他给出的结果是留下难以长期维护的烂摊子。可对照的只有他列举的这套 Anthropic 自有防线,材料没有给出任何一条外部基准。

没写清 材料没给这条「更高门槛」的任何结果指标:回归缺陷率、审查耗时、拦截比例都没有,也没有不配护栏的团队实际付出的代价。

下一步 下一步看 Simon Willison 该条目或其后续文章是否补上 Anthropic 护栏清单或任一项量化结果,以及 Cherny 本人是否公开给出数字。

本期其他新闻

  1. 行业动态

    律师因谋杀案中AI虚构证人被罚款5000美元

    The Verge AI

  2. 行业动态

    圆桌讨论:AI的末日危机

    MIT Technology Review AI

  3. 行业动态

    Meta因其AI和面部识别系统的训练数据被起诉

    Wired AI

  4. 行业动态

    对AI感到难过

    Simon Willison

  5. 行业动态

    Anthropic本周因网络安全问题陷入困境

    The Verge AI

  6. AI工具

    所以你想使用OpenRouter?

    Simon Willison