你今天早上刷到 OpenAI 那条消息了吗?

我一开始以为是营销号又在吹,结果点进去发现,这回他们真的让 GPT-5.6 Sol Ultra 在不到一小时里,证明了一个悬而未决 50 年的图论猜想。说实话,我的第一反应不是兴奋,而是有点慌。这种级别的模型能力,正在以我们意料之外的速度往前跑。

OpenAI GPT-5.6 Sol Ultra 一小时证明 50 年图论猜想

来源,IT之家

OpenAI 宣布 GPT-5.6 Sol Ultra 在不到一小时内完成了「循环双覆盖猜想」的完整证明。这个猜想由数学家 George Szekeres 和 Paul Seymour 在 1970 年代提出,已经困扰学界超过半个世纪。论文借助 GPT-5.6 Sol Ultra 完成核心证明,并用 Codex 验证。

很多人第一反应是「AI 是不是要开始抢数学家的饭碗了」。但现阶段更准确的说法是,AI 成了数学家手里一把更强的铲子,能帮他们更快挖出藏在复杂结构里的线索。

苹果起诉 OpenAI 窃取商业机密,前员工一句「哈哈」成关键证据

来源,IT之家 / 彭博社

OpenAI 这几天麻烦不小。苹果在加州北区联邦法院起诉 OpenAI,指控其系统性窃取苹果商业机密,用于开发 AI 硬件。被告里还包括 OpenAI 硬件负责人 Tang Tan,他之前在苹果干了 24 年,负责过 iPhone 和 Apple Watch 的产品设计。

彭博社的报道里有个细节特别戏剧化。前苹果工程师 Chang Liu 离职时带走了未归还的 MacBook,后来发现软件漏洞还能继续访问苹果内网,他当时在内部聊天里发了句「哈哈,我发现我还能访问网络存储」。这句话现在成了诉讼里的关键证据。

说真的,科技公司的人才流动本来就很频繁,但带走设备、利用漏洞持续访问内部系统,这种操作已经越界了。

蚂蚁集团发布 LingBot-VA 2.0,首个原生具身基础模型

来源,MarkTechPost

蚂蚁集团旗下的具身智能团队 Robbyant 发布了 LingBot-VA 2.0,宣称是首个原生具身基础模型。它采用因果 DiT 架构,视频专家约 13.0B 参数,推理时每 token 约 1.9B 参数激活。

虽然参数规模不算夸张,但原生为具身场景设计这一点很有意思。蚂蚁的思路很清楚,不是先有大模型再往机器人身上套,而是从一开始就把视觉、动作和物理世界理解揉在一起训练。

Claude Fable 5 用 11 天重写 Bun 超 100 万行代码

来源,IT之家

Bun 作者 Jarred Sumner 借助 Claude Fable 5,在 11 天内把 Bun 从 Zig 重写为 Rust。64 个实例并行写出超过 100 万行代码,API 费用大约 16.5 万美元。

他重写的核心理由很实在,Zig 频繁出现内存错误,Rust 能在编译阶段就把很多问题抓出来。Bun 月下载已经超过 2200 万,这次重写如果稳定下来,对 JavaScript 运行时的格局会有不小的影响。

宇树 G1 人形机器人完成首例活体微创手术

来源,Nature / thexpin

《自然》杂志发了一篇论文,展示宇树 G1 人形机器人完成了首例由人形机器人执行的活体标准微创手术。加州大学圣地亚哥团队用 G1 给两只活猪做了腹腔镜胆囊切除术,第二次手术只用了 32 分钟。

这个结果太具体了,反而让人觉得不是遥不可及的科幻。研究团队也承认,机器人还需要反复校正,目前还没法满足人体手术的精度要求。但「首例」这两个字,确实把医疗机器人往前推了一大步。

百度搭子在成都 AI Day 发布四项更新

来源,百度智能云

百度搭子在成都 AI Day 上发布了四项更新,个人版升级、自媒体套件、企业版以及搭子联盟。个人版新增浏览器调用、智能路由、多端共享记忆和强化 PPT 生成,还上架了「一镜」数字人制作和「灵医」报告解读等 Skill。

比较有意思的是,百度这次专门推出了行业首个自媒体专业套件。方向很明确,不光让个人用户用 AI,还要让自媒体创作者把 AI 当成生产工具。

小红书发布大模型新架构 PIPO

来源,小红书技术

小红书提出了 PIPO 架构。它的思路是,在输入侧用压缩器把两个 token 折叠成一个 latent,在输出侧用 MTP head 把隐藏状态展开为额外的 token。输入长度减半,每步输出翻倍。

基于 Qwen3.5-4B/9B 的 backbone 在相关测试上表现不错。这个方向不是简单的「把模型做大」,而是重新设计 token 的流动方式,试图用更少的计算量跑出更高的吞吐。

社交媒体 AI 生成内容泛滥,LinkedIn 超 40% 长文为 AI 写作

来源,Hacker News / Pangram

安全公司 Pangram 通过 Chrome 扩展收集超过 100 万条帖子,分析发现社交媒体上的 AI 内容正在泛滥。整体 AI 检测率是 13.8%,但长文(超过 250 词)里有 25.72% 完全由 AI 生成。

最严重的是 LinkedIn,超过 40% 的长文帖子被标记为完全 AI 生成。这个数字让我挺意外的,因为 LinkedIn 一直被当作职场专业内容的阵地。如果 AI 内容占比继续涨,平台信任度可能会成为下一个被侵蚀的东西。


以上就是今天的科技简报。

GPT-5.6 的数学证明、OpenAI 和苹果的诉讼、宇树机器人的手术,这些新闻单独看都是大事,但放在一起,你会感觉到一个共同的趋势,AI 不再只是停留在发布会 PPT 上的概念,它正在钻进物理世界、法律纠纷、医疗手术和日常内容生产里。

每一环都有人兴奋,也有人担心。这种拉扯感,可能才是 2026 年科技圈最真实的底色。