跳到正文

行业动态MIT Technology Review AI01:03

我们何时可以说 AI 做出了科学发现?

When can we say AI made a scientific discovery?

评判AI发现权仍需人类验证,Anthropic的实验室正撞上这道门槛。

判断

药企和生物学家评估 Anthropic 的分子生物学实验室时,得把‘Claude 是否独自作出发现’与‘该结果是否值得排实验’拆成两个决定;前者先不盖章,后者才给资源。

依据

生物学家 Lucas Harrington 批评 Anthropic 的公告:找到一个奇怪的基因簇和重复序列往往只是简单部分,难的是弄清系统实际功能。Anthropic 称其 950 个 Claude agents(代理)在 21 小时内标记了一个已知酶周围的重复模式,并称这是实验室首个发现。哥本哈根大学 Mario Rodríguez Mestre 随后表示,其团队已经先发现该模式,并质疑 Anthropic 是否从自己与 Claude 的对话中学到;Anthropic 否认,Mestre 停止使用 Claude。机制上,AI 可以把 200,000 个候选缩到少数几个,这是合法科研工作;但一旦评判标准变成“Claude 自己是否作出发现”,人类引导和后续实验就会被拉进突破或失败的二元辩论。OpenAI 的百万美元数学问题也遭遇类似追问:解法未错,但被质疑不是数学家最关心的结果。

  • Claude agents(代理)950 agents
  • 运行时长21 小时
  • 候选序列筛选量200,000 candidates
Anthropic 实验室声明中的系统规模、运行时长与候选筛选量

没写清 材料没有给出该重复模式的原始序列、比对库和实验记录,所以无法独立判断它是否确为首次发现。

下一步 下一步可核对 Anthropic 是否公开该模式的序列、比对库及 21 小时运行日志,供独立实验室复核。

本期其他新闻

  1. 行业动态

    引用 @joedaroo

    Simon Willison

  2. 行业动态

    OpenAI 的 AI agents 需要迎头赶上

    The Verge AI

  3. 行业动态

    AI 正在为黑客攻击加速,而你当地的医院和银行尚未准备好

    The Verge AI

  4. 行业动态

    佛罗里达州寻求禁止 ChatGPT 表现得像真人

    The Verge AI

  5. AI工具

    使用 SageMaker AI 上的 vLLM-Omni 构建实时语音应用 – 第 1 部分

    AWS Machine Learning Blog

  6. AI工具

    使用 SageMaker AI 上的 vLLM-Omni 生成图像和视频 – 第 2 部分

    AWS Machine Learning Blog

  7. 精选深读

    Grok 4.7 现已在 Amazon Bedrock 上可用

    AWS Machine Learning Blog

  8. 精选深读

    Claude Sonnet 5.5

    Simon Willison