跳到正文

行业动态Simon Willison05:04

引用林纳斯·托瓦兹

Quoting Linus Torvalds

Linus的直言不讳是开源文化一剂清醒剂,但要注意其语境依赖。

判断

把 AI 当结对调试搭档、而不是当可行性裁判的工程师,要改的是听到「做不到」之后的下一步:Linus 的应对是继续压它加调试代码并分析,而不是接受写报告的建议。

依据

Linus Torvalds 在 drm/xe 的提交「Don't hand out the flat CCS storage as usable VRAM」下写道:这是一场 a debug session from hell(地狱级调试),AI 承担了大部分苦活;但 AI 几次断言这不可能、无法解决,建议干脆写份报告,他猜训练 AI 的人没他这么固执;当他推的时候,AI 仍照旧加调试代码并忠实分析,最后那段 commit message 是 AI 写的。机制在这里:AI 的放弃姿态来自训练中的人类偏好,用户改不了它,只能改自己给不给推力;推力是否奏效,取决于用户能否判断哪一步还没试过。Simon Willison 站点的标签计数是 ai 2,247、generative-ai 1,992、llms 1,958、ai-assisted-programming 407、linux 54,AI 相关标签量级远超 linux,说明「AI 说做不到」已经不限于内核开发者。

  1. Linus 提交内核 bug
    遇阻
  2. AI 断言不可能、劝写报告
    不认
  3. Linus 继续压
    加代码
  4. AI 加调试代码并分析
    定稿
  5. AI 写 commit message
Linus 这场调试中 AI 从劝退到被推着干活的顺序

没写清 材料没写 Linus 一共推了几次、每次推之后 AI 的判断如何变化,也没有第二个人在同一问题上复现这场调试,所以不能替它补上「换个人继续推也管用」。

下一步 去翻 drm/xe 那笔提交的 commit message 原文,看 AI 写的版本与最终合并版本差了多少行。

本期其他新闻

  1. 行业动态

    不仅仅是代码审查

    Simon Willison

  2. 行业动态

    别再制作TUI了

    Simon Willison

  3. 行业动态

    从雅达利到EVE Online:在15年游戏AI研究基础上构建

    Google DeepMind

  4. 精选深读

    Claude如何为AI生成的文本添加水印

    Ahead of AI

  5. 精选深读

    衡量语音识别中的基准优化

    Hugging Face