跳到正文

精选深读Simon Willison07:48

自然语言文本不存在无损变换

There are no lossless transformations of natural-language text

断言自然语言处理必有信息损耗,提示AI文本变换需设定保真边界。

判断

文档作者据此要做的取舍很具体:哪一句可以交给 LLM 重写,哪一句必须自己扛。审阅者追问时,你不能把责任推回给模型,也不能让读者替这份不确定性买单。

依据

Sophie Alpert 公布了她对工程师使用 AI 写作的内部守则(internal policy on acceptable use of AI writing by engineers),Simon Willison 转发时挑出其中一条:你必须为文档里的每个想法、每句话负责(You must stand behind every idea and every sentence in your docs)。机制在于自然语言没有无损变换——lossless transformation 指改写后一个字面含义都不丢;每一次重写、换词都在改动所指,而执行改写的 LLM(大语言模型)并不持有你本人想传达的那份最细致心理表征,信息就在这一步被丢掉。后果落在审阅环节:同事问「这行你是什么意思」,回答「AI 写的,忽略吧」,等于让读者替这份不确定性付出时间。

没写清 材料没说这份守则怎么落地:谁来判断某句话是否仍代表作者本意,违反之后有什么后果。

下一步 去核对 Alpert 的守则原文是否给出逐句确认、评审检查表这类可执行步骤。

本期其他新闻

  1. 行业动态

    引用 Florian Herrengt

    Simon Willison

  2. 行业动态

    我写了一本AI教科书——还要多久AI能写得更好?

    Interconnects

  3. 行业动态

    从辅助到执行:企业如何让AI落地应用

    OpenAI

  4. 行业动态

    RingCentral如何从工程到运维构建AI原生工作

    OpenAI

  5. 精选深读

    将手语AI交到用户手中

    Google DeepMind

  6. 精选深读

    LFM2.5-VL-3B:为边缘端提供更好、更快的视觉能力

    Hugging Face

  7. 精选深读

    从专有LLM API中窃取推理轨迹

    Simon Willison