跳到正文

汪汪简报

周日 · 2026年09月20日

全部新闻

  1. 数学家讨厌AI。他们却戒不掉它

    行业动态Wired AI

    数学家讨厌AI。他们却戒不掉它
    数学家虽忧虑AI冲击学科根基,却因实用难以割舍,这种矛盾正是科研现状缩影

    这篇报道把数学家的取舍从‘用不用 AI’推到‘用哪家、开不开训练豁免’:Buckmaster 与 Thom 的遭遇说明,投稿前用 Codex 或 ChatGPT 清理论文,先要定署名边界和训练数据条款是否可接受。

    展开全文

    依据

    Buckmaster 告诉 WIRED,他相信 OpenAI 用他的工作抢先解出带 $1 million 悬赏的 Navier-Stokes 存在性与光滑性问题;他和 Anthropic 研究员 Levent Alpöge 用过 Codex(OpenAI 的编码代理)和 Claude,OpenAI 部署了 tens of thousands of agents,随后在公告中称 Buckmaster 在 September 8, 2026 论文前 two months 的 Codex 提示不可能影响系统,包括训练。Thom 则说,OpenAI 的 Astra 模型用了他投入 two decades 的几何群论技巧证明一个老问题;他邮件质询 Sellke 和 Bubeck,指出公司忽略其 2019 年论文,OpenAI 修改了新闻稿。机制是:只要未发表推导先经过模型,而企业默认是否用数据训练不透明,优先权和贡献链就无法追溯;Thom 说 AI 让追溯谁贡献了什么“probably over”。

    没写清 材料没有给出独立审计或训练数据溯源记录,无法确认 Buckmaster 与 Thom 的未发表内容是否真的未进入模型。

    下一步 核对 OpenAI 对 Navier-Stokes 公告的修订版本是否列出调查范围、时间线和训练数据隔离方式。

  2. 11月4日来迈阿密参加WIRED World Fair

    行业动态Wired AI

    11月4日来迈阿密参加WIRED World Fair
    WIRED把线上叙事搬到迈阿密一日线下,适合想直接接触技术圈资源的人。

    想去 11月4日 迈阿密 Wynwood 那间 Sacred Space 的人,得在「照现有名单先订机票」和「等主办方把追加议程放出来再订」之间选一边:先订的人自己承担名单不如预期、以及单日撞场的代价。

    展开全文

    依据

    WIRED 9月19日发文说,11月4日在迈阿密 Wynwood 的 Sacred Space 办一日展会,把世界博览会百年来「先看一眼下一步」的做法压进一天。已点名 Hugging Face 首席执行官(CEO,公司最高管理者)Clément Delangue 讲谁拥有 AI 的未来、Reddit 联合创始人 Alexis Ohanian 讲风险投资(VC)往哪走、Colossal Biosciences 的 Ben Lamm 讲去灭绝,Unitree 的 G1 人形机器人会在场地里走动。机制是把线上报道里的名字收进一间屋子,用一天差旅换当面提问的机会;代价是全部内容挤在同一天,而且文章写明还会继续加节目,所以越早订票,越是在为一份没定稿的名单付款,提问机会也要跟同场所有人分。

    没写清 材料没有场次时间表,也没写票价和余票,所以无法判断哪天订算早、哪天订会买不到。

    下一步 盯 WIRED World Fair 官网的议程更新,看追加场次是否占用 Delangue 或 Ohanian 的时段。

  3. [AINews] 两天内出现了6个Jev的克隆

    行业动态Latent Space

    [AINews] 两天内出现了6个Jev的克隆
    Jev两天被克隆6个,模仿门槛低了,产品差异更难立住。

    如果你在做模型或代理产品,现在该把预算从‘证明能力’挪到‘证明差异’:Jev 两天冒出6个克隆,模仿门槛已经低到让先发优势按周计价,而不是按季度。

    展开全文

    依据

    Vercel 说 Jev 是 AI Gateway 历史上采纳最快的模型:首日 @typesafeai 覆盖约13%团队,是 GPT-5.6 家族的2倍、Fable 5.1 的6倍。Jev 本身是非生成式决策模型(discriminative decision model,判别式决策模型),被当作快速‘System 1’补 LLM。@madiator 发布 Bespoke Nimble,用 Qwen3.5-9B 做 LoRA(低秩适配,一种低成本微调方法),在自有评测上把基础 Qwen 从66%提到90%,Jev 为93%。@jaredpalmer 的 Kev-0.5B 能在 MacBook Pro 跑。机制是数据侧被承认 100% 合成,后来者用对比数据、约束解码和小分类头就能逼近;代价是速度信号盖过质量信号,@abacaj 指出仍无标准基准,买家没法把‘快’直接折算成‘更少错误’。

    • 基础 Qwen66%
    • Bespoke Nimble90%
    • Jev93%
    Bespoke Nimble 与 Jev 在同一评测上的准确率对照

    没写清 材料没说这些克隆在真实生产任务上的错误率、延迟分布和合规成本,所以不能替它补上‘谁更可靠’的结论。

    下一步 下一步可核对:是否出现跨厂商的 Jev 类标准基准,并公布各克隆在同一任务集上的准确率与延迟。

  4. 银行不需要封闭区块链。那为什么它们一直选择它们?

    机构与应用a16z Crypto

    银行不需要封闭区块链。那为什么它们一直选择它们?
    银行偏爱封闭链,图的是合规与掌控,代价是牺牲公共链的开放流动性。

    银行合规主管可以停掉「必须自建许可链才能过 BSA 与制裁审查」这条内部假设:控制点放在机构自己运营的那一层就够,不必去筛全网。

    展开全文

    依据

    论文作者 Rebecca Rettig 是 Jito Labs 的首席运营官兼首席法务官(Jito Labs 开发 Solana 区块链软件与基础设施),她与 a16z crypto 合写的这份指南主张:机构可以在无需许可网络上建产品并交易。机制在 BSA(银行保密法,含反洗钱 AML 与反恐融资 CFT 要求)和制裁法本身——它们要求的是「合理设计」的项目、以及对已识别风险成比例的控制,不是把风险清零,控制点可以只放在机构运营的那一层。FinCEN(美国金融犯罪执法网络)2020年8月的执法声明称其执法不是「抓错」游戏;财政部关于去风险化的报告指出罚款罕见,且通常跟随整个 AML/CFT 项目崩塌,而不是风险为本方法下偶发的有限缺陷。OFAC(美国财政部海外资产控制办公室)的合规承诺框架列了五项要素:管理层承诺、风险评估、内部控制、测试与审计、培训。已发生的对照:Franklin Templeton 自 2021 年起把链上美国政府货币基金的官方份额登记放在无需许可链上、2025年2月接入 Solana;BlackRock 自 2024年3月起在以太坊发行代币化货币市场基金份额;Apollo 在 2025年1月把 Diversified Credit Fund 的代币化通道铺到六个无需许可网络。

    1. 管理层承诺
      先行
    2. 风险评估
      据此
    3. 内部控制
      检验
    4. 测试与审计
      补强
    5. 培训
    OFAC 合规承诺框架列出的五项要素及其推进顺序

    没写清 材料没给出任何一家银行因在无需许可网络上运营而被 FinCEN 或 OFAC 处罚、或明确免责的个案,因此不能替它断言监管实践已经认可。

    下一步 看 FinCEN 是否把 2020年8月的执法声明更新为点名无需许可网络。

往期

  1. 09.29周二

  2. 09.28周一