跳到正文

2026年09月08日AI 版

6 条 · 2 个来源

头版

行业动态Simon Willison

令人毛骨悚然的小爬虫
若你讨厌爬虫,此更新无实际价值;但功能本身确实能消解部分恐惧。

运维公共 Git 仓库和开放数据集的人,得把「给爬虫渲染页面」当成常态容量成本写进预算,而不是等它挤垮服务再靠封 IP 应急。

展开全文

依据

Konstantin Ryabitsev 说,在 Linux 内核官方仓库 git.kernel.org 上,为抓取工具渲染 commit 页面所消耗的 CPU 周期,比包括 git clone 在内的所有合法访问加起来还多;5 个地理分布节点上,常驻 14 个 CPU 核心只做把 commit 渲染成 HTML 这一件事。Simon Willison 说,他从 Datasette(他自己做的开源数据发布工具,会输出大量可被爬的网页)的角度同样担心。机制在于成本落在「渲染」这一步:爬虫要的不是 Git 对象,而是网页界面,每个页面都要服务端现算,缓存命中率低,于是烧掉的不是带宽而是 CPU 时间。取舍也在这里——按 IP 封禁会误伤真实访问者,加缓存或限流要动架构,Ryabitsev 把 14 核摆出来当常态开销,等于承认目前只能硬扛。

  1. 爬虫抓取 commit 页
    非 git clone
  2. 服务端实时渲染 HTML
    缓存命中低
  3. 5 节点 14 核被占住
爬虫请求如何一步步变成服务端的渲染开销

没写清 材料没点名这些爬虫是谁、是否已有限流或缓存措施,也没给合法访问侧对应的 CPU 数字,所以 14 核究竟占总容量多少,无法替它算出来。

下一步 下一步可核对:git.kernel.org 或 Datasette 若公布限流、缓存方案,实施前后用于渲染的 CPU 核心数是否下降。

行业动态

5

  1. 行业动态Simon Willison

    引用 Jakub Pachocki 的话
    OpenAI科学家的表态值得业内对照自家路线,代价可能是忽略开源社区的实际进展。

    它改变的是采购与安全团队的风险记账方式:「能力更强」此前只被算作待评估的风险项,现在被建议同时算作防御投入。代价是评估预算和验收责任压到部署方,一旦对齐失效,先承担后果的是他们而不是发言方。

    展开全文

    依据

    OpenAI 首席科学家 Jakub Pachocki 在 9月7日 的表态给出一个两步论证:要防御其他 AI 带来的危害,就需要强大且 aligned(对齐,指模型行为与人类意图一致)的 AI,用来保护基础设施、实时防范 rogue agents(失控智能体);同时他又补一句,即便存在这种不确定性和防御需求,也不能让它变成鲁莽的借口,「不惜代价往前冲」是荒谬的。机制上这是一个自指循环:防御能力由与威胁同一条训练路线产出,所以「继续快训」既是手段也是风险源。他没给判定线——什么算防御、什么算鲁莽、由谁在哪个节点叫停,材料里都没有。代价分配是清楚的:模型方由此获得叙事上的正当性,部署方与采购方要在自己的预算和合规流程里为「防御」这个新名目买单。按他的框架,选择放慢的人反而要先自证不会害人。

    没写清 材料没说「防御」的验收指标、时间表,也没说谁有权判定某次训练已经越过鲁莽线。

    下一步 看 OpenAI 后续是否公布防御部署的可测指标或清单,否则这句话只停在论证层面。

  2. 行业动态Simon Willison

    墨卡托投影 ↔ 等积地球投影
    墨卡托投影与等积地球投影的转换工具,地图可视化选型时需权衡形状与面积失真。

    做世界地图的编辑、GIS 前端和教材作者,可以不再用「默认墨卡托」一刀切:要比面积就把 Equal Earth 摆上来,要保角导航就留墨卡托,并把这个可拖动的过渡动画当作评审时摊开取舍的证据;代价是每用一次都得先说清这张图要服务哪一种判断。

    展开全文

    依据

    Simon Willison 在 9 月 7 日的帖子里说,他是因为联合国刚就 Equal Earth 投影投票才起了好奇,于是让 ChatGPT Work 里的 GPT-6 Astra(medium)用 D3(浏览器端数据可视化库)做出了这个能在墨卡托与 Equal Earth 之间渐变的动画。机制上,投影是把球面摊平到平面的映射:墨卡托保角,即局部形状与方向不变,代价是高纬度面积被放大;Equal Earth 保面积,代价是高纬度的形状被拉伸。滑块本质上把这个取舍变成一个连续参数,中间帧两种性质都不成立,只能当谈判用的示意图,不能当底图用。原文自带的对照是标签计数:vibe-coding 97、geospatial 85、d3 15、gpt-6-astra 9,产出靠的是提示词而非 D3 经验,所以它是评审道具,不是制图库的替代品。

    • vibe-coding97
    • geospatial85
    • d315
    • gpt-6-astra9
    Simon Willison 这篇帖子的四个标签计数对照

    没写清 材料没给任何纬度上的面积误差数字,也没说这动画覆不覆盖 Web Mercator 瓦片或极区投影,所以「具体差多少」补不出来。

    下一步 可核对的下一步是查联合国对 Equal Earth 的那次投票记录,找出会议与日期,确认原文「recently voted on」指的是哪一场。

  3. 行业动态OpenAI

    支持乌克兰的独立新闻业
    三方合推AI项目惠及乌克兰媒体,但支援范围与成效待观察。

    这条公告压在乌克兰中小型编辑室主编桌上的是一个取舍:要不要从战时本就紧张的人力里抽出记者去跑 AI 试点。十家深度指导名额框定了受益面,多数机构只能先看大师课案例能否平移到本地语种与低预算场景,再决定投不投人。

    展开全文

    依据

    OpenAI 与另外两家机构联合宣布,以 AI 应用和商业转型两条线支援乌克兰独立媒体,但公告未点名合作方,也未公布入选名单。机制分两层:先由大师课(面向新闻编辑室的公开案例分享)铺开国际经验,再由催化剂项目对十家入选机构做深度指导——识别可用场景、制定路线图、试点 AI 方案,并配套 OpenAI API(调用其模型接口的配额)额度。设计意图是压低乌克兰媒体采用 AI 的门槛,让记者把省下的时间放回采访与核查。代价落在名额上:十家之外是否还有支持没有提及,地方小型媒体在不在其中无法从材料判断,而且披露的内容止于项目设计与启动时间。

    1. 大师课分享国际案例
      遴选
    2. 十家入选新闻机构
      深度指导
    3. 识别用例与路线图
      推进
    4. 试点 AI 方案
      配套
    5. OpenAI API 额度
    支援从公开大师课收窄到十家机构,再落到试点与 API 配额。

    没写清 材料只给出项目设计与启动时间,入选机构名单、执行成效和后续资金来源都没有,所以无法判断支援是否落到最基层的地方媒体。

    下一步 等三方公布十家入选机构名单或首份试点成果,再核对基层地方媒体是否在列。

  4. 行业动态OpenAI

    外星人的思维
    OpenAI首席科学家反思能力跃升与对齐难题,呼吁更强防护,但未提具体措施。

    这一篇改变的,是那些把「国际协调」当作对齐风险兜底、据此排期模型上线的人:在拿不到可验证保证前,外部共识不该被写进发布条件。

    展开全文

    依据

    OpenAI 首席科学家帕乔基在文中给出的判断是:随着 AI 能力跃升,模型行为越来越像「异类心智」(标题原文 An Alien Mind,指其行为无法用人类意图来解释),对齐(alignment,指模型行为与人类意图保持一致)的难度随之上升。他因此要求更强的防护措施,并强调国际协调的必要性。但材料同时点出,文中没有给出任何具体技术路径或机制证据,也没有讨论防护措施的代价和副作用,例如过度限制可能拖慢能力发展;而当前对齐挑战的现实是,即便先进实验室也缺乏可验证的保证手段。把这两头放在一起看:呼吁停留在原则层面,而落地需要的是能写进验收清单的东西,所以它能推动的是预算和优先级,不是验收标准。

    没写清 材料没说防护措施具体怎么做、代价由谁承担,也没说不同国家利益如何制约协调,这些不能替它补上。

    下一步 核对 OpenAI 后续是否公开可验证的对齐评估方法或具体防护细则。

  5. 行业动态OpenAI

    研究加速:OpenAI 内部视角
    OpenAI自曝编码代理提速研究,但样本与指标待考,别急着全信。

    对打算把编码代理嵌入实验循环的实验室负责人,这条自曝只够支持“先做内部小规模对照试点、暂缓替换人工编码环节”的决定;提速若来自高度工程化环境,收益归大平台,复现成本却由小团队承担。

    展开全文

    依据

    OpenAI称,其内部数据显示编码代理已进入研究流程,能自主写代码、调试并参与部分实验设计,从而让研究人员并行验证更多假设。机制是减少人工干预、把实验迭代拆成可并行任务;但材料没有给出任务类型、样本量和基线,读者无法判断“提速”是相对人工、相对旧脚本,还是相对小样本特例。取舍在这里:代理越能替研究者执行想法,团队越依赖高度工程化环境,小机构要先付出复现成本;同时研究者若少做问题定义,深层判断力可能被工具替代。因此这份数据只能当作探索性信号,不能直接外推为普适增益。

    没写清 材料未披露样本量、任务类型、基线对照和成本数据,所以无法替它给出可复现的增益幅度。

    下一步 等OpenAI公布样本量、任务类型与基线对照,或等外部团队按同环境复现后再评估。