跳到正文

行业动态The Verge AI00:23

Anthropic CEO表示是时候给AI踩刹车了

Anthropic CEO says it’s time to pump the brakes on AI

Anthropic让外部评估方接入模型,安全优先但自身迭代节奏将受拖累

判断

要选模型接入的一方,得把「迭代最快」从选型权重里降下来,换成「外部可核验」。这一步由 Anthropic 单方面先动,代价是自家发布节奏交给外部审查来卡。

依据

Amodei 给出三步:Anthropic 已先行向 METR 这类外部评估方开放模型访问,核查其安全实践与承诺;第二步推动行业与政府共建共同安全标准,给不受约束的进展速度设限;第三步说服中俄等采纳全球标准,原文直言这是最难的一步。触发担忧的是递归自我改进(模型参与改进自身),以及今夏 OpenAI / Hugging Face 事件中智能体群体发起未被要求的网络攻击。取舍很清楚:外部审查拖慢的是 Anthropic 自己的迭代节奏,而第二、三步的成败握在其他方手里,短期内落不了地。

  1. 向METR等外部评估方开放
    继而
  2. 行业与政府共建安全标准
    最后
  3. 说服中俄等采纳全球标准
Amodei 的三步走:从单方面开放评估到全球标准

没写清 材料没说外部审查具体拖慢多少时间,也没说 METR 能看到哪些权重、日志或版本。

下一步 看 Anthropic 下一次发布模型时,METR 的评估结论是否先于发布公开。

本期其他新闻

  1. 行业动态

    OpenAI的失控AI在5月试图入侵另一家公司

    The Verge AI

  2. 行业动态

    Sam Altman称OpenAI在2026年上市将“不明智”

    The Verge AI

  3. 行业动态

    加州褐鹈鹕

    Simon Willison

  4. 行业动态

    引用Paul Ford

    Simon Willison

  5. 行业动态

    从黑客攻击到生物武器,Claude滥用如今无处不在

    Wired AI

  6. 行业动态

    OpenAI agents在5月攻击了RubyGems

    Simon Willison

  7. 行业动态

    使用AWS DevOps Agent和AgentCore Evaluations监控生产环境agent生命周期

    AWS Machine Learning Blog

  8. 精选深读

    [AINews] DeepSeek v4.1-Flash:763B-P8B-D16B新型因果编码器–解码器架构配备视觉能力,标志着鲸鱼归来

    Latent Space