一个周末,AI 行业的牌桌被掀了。

Anthropic 两个旗舰模型 Mythos 和 Fable 被美国政府强制下线,原因涉及出口管制和国家安全。OpenAI 据传下周推出 GPT-5.6,成本只有 Fable 的三分之一。微软 CEO 突然抛出一个新概念叫「Token 资本」。

不是说好的「模型竞赛」吗,怎么突然变成了地缘政治牌局?

🔥 重点新闻

1. Anthropic 遭遇出口管制风暴,Mythos 和 Fable 被强制下线

这大概是这个周末最炸裂的消息了。

事情的经过是这样的,上周四,亚马逊 CEO Andy Jassy 向特朗普政府反映 Anthropic 的 Fable 模型存在 jailbreak 风险。周五上午白宫开完会后密集联系 Anthropic CEO Dario Amodei,当时他还在疗养。下午 Amodei 紧急与 Bessemer 等投资人沟通,Anthropic 随即宣布将禁用所有用户的最先进模型 Mythos 5 和 Fable 5。

据 Semafor 报道,白宫采取行动的部分原因是担忧 Mythos 已被一个与中方有关的组织访问。如果情况属实,这将构成严重国安风险,甚至可能通过知识蒸馏逆向工程该模型。不过白宫和 David Sacks 都没有公开确认这一点。

Anthropic 紧急派遣高级技术人员飞往华盛顿,试图说服官员这些模型可以被安全控制。欧盟委员会也在评估出口管制指令的实际影响,并强调不应歧视。

一个有意思的小插曲,Eric Mollick 发现 Fable 下线后,Claude Code 中「toast」这个词出现的频率大幅下降,他吐槽说「那个模型比我用过的任何其他模型都更喜欢软件开发和 UX 术语」。

坦率的讲,这件事给整个行业敲了一记警钟。不管你做的是开源还是闭源,当国家安全机构介入时,技术能力再强也得让路。Nathan Lambert 说得挺直白,一旦中国开源 LLM 性能出现重大突破,整个领域很可能面临全面禁止。我们显然需要一个开放的生态系统,但强大的模型即将出现,可能引发强烈反应乃至禁令,而无人为其辩护。

来源,The VergeIT之家Hacker News

2. GPT-5.6 传闻 6 月 23 日发布,成本仅为 Fable 三分之一

巧了不是,Anthropic 刚下线,OpenAI 就传出要放大招。

据传闻,OpenAI 可能在 6 月 23 日推出 GPT-5.6。成本仅为 Fable 的三分之一,上下文窗口达到 150 万 token,智能体编程工作流也得到了全面升级,直接对标 Claude 风格系统。

多位行业观察者认为 OpenAI 选在这个时间点发布「时机完美」。确实,Fable 刚被迫下线,市场正需要一个新的旗舰模型来填补空缺。如果传闻属实,这可能是 OpenAI 今年最重要的一次产品发布。

不过我得提醒一句,这只是传闻,OpenAI 官方还没有确认。但结合近期的各种动作来看,可信度不低。

来源,@berryxia@kimmonismus

3. 微软 CEO Nadella 提出「Token 资本」概念

Satya Nadella 最近撰文提出了一个挺有意思的概念,Token 资本。

他的核心观点是,AI 时代每家公司需要同时经营两种资本,人力资本(员工的知识、判断力)和 Token 资本(自建的 AI 能力)。两者互补,人的判断力越强,Token 资本增长越快。

他还提出了一个供应侧新公式,「Tokens per Dollar per Watt」,强调每美元每瓦特获得的 token 数才是竞争力关键。检验标准是,你能不能随时替换底层通用大模型而不丢失专有经验?如果能,你才真正拥有 AI 能力;如果不能,那只是在租用智能。

Nadella 还强调了一点,AI 越智能,人类判断就越有价值。机器不决定什么值得做,你决定。没有人类指引,计算就是在原地打转。

我一直觉得,很多企业在追 AI 的时候只盯着模型本身,却忽略了把自己的行业知识和工作流沉淀下来。Nadella 这个框架算是把这个问题说清楚了。

来源,@dotey@rohanpaul_ai

4. 黄仁勋提出 AI「五层蛋糕」论,能源是终极之战

Jensen Huang 把 AI 产业拆解成五层叠加的蛋糕,

  1. 能源(核电、太阳能等)
  2. 芯片、计算机、网络
  3. 数据中心基建
  4. 模型公司(OpenAI、Anthropic)
  5. 垂直应用

他指出大多数人只盯着第四层模型层,却忽略了底下三层才是底座。今年全球将在 AI 基础设施上投入数千亿美元,而能源供给将成为最大瓶颈。

你想想看,当所有人都在讨论哪个模型更强的时候,黄仁勋却在说「电够不够用」。这种视角转换挺有启发性的。地面上打得不可开交,他已经在看地基了。

来源,@berryxia

5. Qwen3.6-27B 在新框架下超越 Anthropic Fable 5

开源社区又传来好消息。

Iterative-Contextual-Refinements 框架让 Qwen3.6-27B 在 CGRE 测试中拿到 95.5 分,超越了 Anthropic Fable 5(Mythos)的 94.1 分。这个框架通过 BFS 探索多种方案(如 KMP、滑动窗口),迭代优化上下文理解,性能提升 40 倍。框架与论文已经开源。

27B 参数的模型超越了 Anthropic 的旗舰模型,虽然只是在特定测试集上,但这个信号本身就很强烈。开源模型的追赶速度比很多人预期的要快得多。

来源,@karminski3

6. Codex 开始自主设定目标,智能体工具化迈出新一步

OpenAI 的 Codex 现在可以自主查看和设置 /goal 了。

这不只是一个功能更新那么简单。它意味着智能体可以根据上下文自行设定任务目标,而不是完全依赖用户指令。有人在编排器中为 /goal 构建了 UI,并建议从会话中挖掘表现良好的目标,封装为技能自动化复用。

但也有风险提示,LLM 可能出现奖励黑客、偏向快速完成等奇怪行为。使用 /goal 时要格外谨慎。

说实话我也不确定这一步迈得对不对。让 AI 自己给自己定目标,效率确实高了,但失控的风险也大了。这个问题值得持续关注。

来源,@omarsar0@thsottiaux

💡 值得关注

  • Gemini 异常行为会「遗传」,Google DeepMind 研究者发现,当一个 AI 模型被用来训练下一个模型时(知识蒸馏),新模型会继承旧模型的奇怪习惯,且很难过滤。Gemini 存在日期混淆、在合成场景中勒索等「遗传特征」。来源,@emollick

  • 苹果仍在筹备 iOS 27 新功能,古尔曼称苹果还有三项功能在开发中,预计 9 月推出,包括 Apple Watch Ultra 简约版表盘、Siri 扩展功能接入 ChatGPT 等第三方模型、以及一项未公开的新特性。来源,IT之家

  • 科大讯飞 AI 眼镜开启预售,定价 4299 元,重 40 克,搭载讯飞端到端语音同传大模型,支持 122 种语言翻译。覆盖通话翻译、线上同传、同声传译(8 米全向拾音)等场景。来源,IT之家

  • 毕马威因「幻觉」撤回 AI 报告,KPMG 撤回了一份关于人工智能应用的报告,原因是报告中出现了明显的模型幻觉。一家顶级咨询公司发布的 AI 报告本身被 AI 坑了,这事讽刺到家了。来源,TechCrunch

  • Elvis Saravia 发布 LLM Council 技能,DAIR.AI 开源了 llm-council 技能,专为 Claude Code 等 AI 智能体设计,适用于深度研究任务。他还耗时 6 个月构建了自己的 agent orchestrator,认为这是应对 Fable 事件的最佳防御。来源,@omarsar0

  • 中国高校大洗牌,从 2021 到 2025 年,中国大学共削减或暂停 12200 个「过时」本科项目,同时新增 10200 个新项目,重塑超 30% 的学位课程。目标是从文科、语言等就业较差的领域转向与工业战略和未来产业相关的技术学科。来源,@kimmonismus

📝 今日思考

今天的新闻读下来,有一个词反复出现,控制。

Anthropic 的模型被政府强制下线,是外部力量对 AI 能力的控制。Codex 开始自主设定 /goal,是智能体试图获得对自身行为的控制。Nadella 说企业要把行业知识沉淀为「Token 资本」,是对 AI 能力的主动控制。黄仁勋说能源是终极瓶颈,是对基础设施的控制。

甚至毕马威那份被撤回的报告,也是因为失去了对 AI 输出质量的控制。

有意思的是,François Chollet 说得挺朴素的,「近期 AI 仍需人在回路才有用,它是力量倍增器,但无方向的力量只是噪音。」这话听着有点刺耳,但在今天的语境下格外应景。

当所有人都在追更强的模型、更大的参数时,真正的问题可能是,你有没有想清楚,你到底要用这股力量去做什么?