科技简报 | 2026年07月10日
早上起来刷 RSS,满屏都是 OpenAI、Anthropic 和 Google 的新消息。说真的,我已经有点免疫了。但有三条来自国内团队的消息让我停住了,蚂蚁灵波一天放出两个开源模型,OpenBMB 社区又出了个本地数学 Agent。你想想看,国外大模型还在卷榜单,国内团队已经开始把模型往机器人、本地设备和数学场景里塞了。
这可能就是今天最值得看的地方。
蚂蚁灵波开源 LingBot-Video,具身智能有了 MoE 视频基模
第一个消息是蚂蚁灵波开源的 LingBot-Video。按官方说法,这是全球首个面向具身智能的 MoE 视频基础模型。30B 参数,推理时只激活约 3B,效率比同规模 Dense 架构高三倍左右。训练数据包含 7 万小时的 VLA、VLN 和 Ego 机器人视频。
我做产品的朋友可能知道,机器人之前缺的不是硬件,而是怎么把视频理解、动作规划和大模型串起来。MoE 加视频生成这条路,坦率的讲,成本还是挺诱人的。
具身智能的基模,终于开始接地气了。
来源,IT之家
同一天,LingBot-World 2.0 给机器人搭了个「虚拟训练场」
灵波还没停手,接着又丢了 LingBot-World 2.0 出来。这是一个 14B 参数的实时交互世界模型,支持施法、攻击、跳跃这类角色动作,还能用文本驱动事件,比如切换场景、召唤风暴。它内置了 Pilot Agent 和 Director Agent,让整个世界能持续演化。
这听起来更像游戏引擎,但它真正的野心可能是给机器人提供一个可训练的虚拟环境。
机器人训练场,开始自己长出来了。
来源,IT之家
TeXada,一个本地跑的数学 Agent
另一个让我意外的是 OpenBMB 社区推出的 TeXada。它基于 MiniCPM5-1B 和 MiniCPM-V 4.6,所有推理在本地完成,支持自然语言转 LaTeX、手写和图像公式 OCR、LaTeX 补全与错误修复。
数学公式识别这件事,我踩过坑。之前很多在线工具要么隐私不放心,要么 LaTeX 错一行就全崩。本地跑,这点真的戳中我了。
来源,OpenBMB 官方
744B 的 GLM-5.2,也能在消费级电脑上跑了
Hacker News 上有个热门帖子,讲的是怎么在低配置电脑上运行 GLM-5.2。用的 colibrì v1.0 引擎,纯 C 实现,零运行时依赖,约 25 GB 内存就能跑 744B 参数的 MoE 模型。int4 量化后磁盘占用约 370 GB,常驻内存只有 9.9 GB。
GLM 是智谱的模型,这等于说国产大模型也可以在消费级硬件上玩了。我跟你说,这对比需要动辄 8 张 H100 的部署方案,完全是另一个世界。
744B 的模型,不到 10GB 常驻内存,你敢信?
来源,Hacker News 热门(buzzing.cc)
Anthropic 利润超 10 亿美元,IPO 箭在弦上
跳回国外,Anthropic 今年第三季度利润预计超 10 亿美元,还已经在 6 月 1 日秘密提交了 IPO 申请。如果成功,可能成为规模最大的 AI 实验室 IPO。
OpenAI 和 Anthropic 的年度经常性收入合计接近 1000 亿美元。这个数字听着很震撼,但我始终觉得,能不能把收入变成可持续的现金流,才是关键。
来源,IT之家
特斯拉第三代 Optimus 定型,马斯克放了狠话
特斯拉第三代 Optimus 人形机器人初步定型,马斯克已经评审通过,即将量产。供应链要求 9 月产能达到 1000 台每周,年底升到 2000-2500 台,届时年产能可达 10 万台。
马斯克还放话,如果采购团队年底达不成产能目标,就把整个团队开掉。这话听着有点刺耳,但也能看出他对量产有多急。
来源,IT之家
法国对英伟达反垄断调查接近尾声,CUDA 生态是焦点
法国竞争管理局确认,对英伟达的反垄断调查已接近尾声。核心关注点是市场对 CUDA 平台的严重依赖,以及英伟达对 CoreWeave 等 AI 云计算公司的投资。如果认定滥用市场支配地位,最高可罚全球营收 10%。
这不会立刻改变英伟达的地位,但会给国产 AI 芯片和开源生态多一点喘息空间。很多朋友可能不知道,CUDA 生态的护城河,比硬件本身还难打破。
来源,IT之家
一点感受
今天这些消息,让我印象最深的是两件事。
一是国内团队不再只跟在国外模型后面做复刻,而是把模型塞进更具体的场景里,比如机器人、本地设备、数学公式。二是部署成本正在以肉眼可见的速度下降,一个 744B 的模型能在消费级电脑上跑,这放在两年前简直不敢想。
其实,技术最后还是要落到普通人能用的产品上。榜单再好看,也不如一个真实场景里的顺手体验。
明天见。







