今天AI圈又炸开了锅。短短八天之内,Grok 4.5、GPT-5.6、Muse Spark 1.1、Kimi K3 四款前沿模型接连发布,把 Intelligence Index 得分超50的实验室从6月初的2家直接怼到6家。但这轮混战里,最让我觉得有意思的,不是谁参数更大,而是中国玩家开始在几个关键赛道上露出獠牙。

1. Kimi K3 前端编码登顶,月之暗面也亮出技术底牌

月之暗面最近动作密集。先是Kimi K3在 Frontend Code Arena 以1679分登顶,压过 Claude Fable 5 和 GPT-5.6 Sol,7个前端细分赛道拿下6个第一。紧接着CEO杨植麟在GTC 2026上披露了Kimi K2.5的技术路线,MuonClip优化器替代Adam、线性注意力、Agent Swarm这套组合拳,摆明了要在工程和长上下文上硬刚一把。

坦率的讲,国内大模型发布会我看了不少,但能同时拿出优化器、注意力架构和Agent系统三条线的,确实不多。月之暗面这次是把自己压箱底的东西掏出来了。

来源,AIHOT / @AYi_AInotes、@dotey

2. 通义Wan-Streamer v0.2,端到端延迟降到550ms

阿里通义实验室把 Wan-Streamer 升级到 v0.2,号称「听、看、说、演」统一进单个 Transformer,端到端响应延迟只要550ms,输出分辨率从192×336提升到640×368。这数字听起来可能没那么性感,但真做过实时交互 demo 的人都知道,550ms 和 1.5 秒是两种完全不同的产品体验。

同一批发布里,通义还公开了「智绘科普」的技术拆解,用 Qwen3.5-397B-A17B 加 Manim 做多Agent协作教学动画。这个方向我挺看好,教育内容生成最难的不是画面,而是知识结构和动画逻辑的咬合,Agent 分工做规划、草稿、实现、修复,确实比单模型硬上更靠谱。

来源,AIHOT / 通义实验室

3. 百度秒哒3.5 全球首发 iOS App,无代码也要卷原生

百度智能云在WAIC2026发布秒哒3.5,最大的亮点是能在没有 Mac 和 Xcode 的情况下把应用打包成 IPA 并上架 App Store。这对国内无代码平台来说是个关键突破,以前很多做无代码的小团队,到了快上线的时候都卡在「我生成的是网页,不是原生 App」这一步。

新版本还加了 SEO Agent 和多应用共享后端。怎么说呢,百度这次是在把无代码从「玩具」往「真生意」推,但能不能成,还得看实际上架审核通过率和后端稳定性。我自己是吃过无代码平台崩溃的亏的,所以对这个保留一点观望。

来源,AIHOT / 百度智能云

4. 面壁智能开源 StaffDeck,企业数字员工平台

面壁智能联合多团队开源了 StaffDeck,一个构建企业数字员工的平台。它不是传统聊天机器人,而是把专业知识、SOP、决策规则转成能持续工作、改进并保留组织知识的数字员工。

这块其实挺难的。我接触过几家用 RAG 做内部知识库的项目,到后来都发现「知识放进去」只是第一步,「员工真的愿意用」和「流程能跑起来」才是要命的地方。面壁这条路如果走通了,可能比做通用对话模型更值钱。

来源,AIHOT / OpenBMB

5. 世界人工智能合作组织协定在上海签署,总部落地中国

7月16日,成立世界人工智能合作组织协定签署仪式在上海举行,王毅代表中国政府签署协定。总部设在上海,29个国家代表参加。这是一个独立的政府间国际组织,目标是促进AI国际合作与全球治理。

这件事的分量不在于技术,而在于规则。AI治理的话语权现在大家都在抢,组织总部落地上海,至少说明中国在这场博弈里拿到了一张重要牌。后续能不能真的影响标准制定,才是关键。

来源,AIHOT / IT之家

6. 小红书HYPIC,把大模型缓存做成位置无关

小红书联合北大、上交提出 HYPIC,首个混合注意力大模型的位置无关缓存系统。效果很直接,首 token 延迟平均降3.25倍,同 SLO 下可持续 QPS 提升1.66倍,任务质量只比完全重算差1.71分。

这块其实挺难的。做推理优化的人都知道,缓存和重算之间一直是在做 trade-off,HYPIC 能在延迟和 QPS 上拿这么大提升,质量损失还这么小,说明这个位置无关的思路确实切中了要害。小红书技术团队这两年在大模型基础设施上的投入,开始见真章了。

来源,AIHOT / 小红书技术

7. 苹果与OpenAI法律战升级,约40名前员工收到律师函

苹果已向约40名就职于OpenAI的前员工发出律师函,要求保存相关文件。苹果称已有超400名前员工在OpenAI工作,正寻求法院禁令阻止OpenAI使用苹果商业机密。这场官司从起诉OpenAI及两名前员工,到现在扩到40人,明显是动真格了。

说实话,硅谷大厂互相挖角早就不是新鲜事,但苹果这次摆出的姿态,更像是在 AI 硬件和语音助手这条赛道上感到了真实威胁。新 Siri AI 的公测版刚推,OpenAI 的语音和端侧能力又追得紧,苹果不急才怪。

来源,AIHOT / IT之家、The Verge

8. 台积电上调资本支出,A14制程进展顺利

台积电在2026Q2财报说明会上把2026年资本支出预测上调到600~640亿美元,之前是接近560亿美元。董事长魏哲家说,2028年量产的A14制程(1.4nm)开发顺利,移动和HPC客户兴趣强烈。

钱加在哪儿,产业就往哪儿走。资本支出多出来的几十亿美元,大概率会砸进先进封装和 AI 芯片产能。国内芯片设计公司在先进制程上依然受限,但封装和成熟制程的机会还在扩大,这件事值得持续盯。

来源,AIHOT / IT之家

一点观察

今天这堆新闻里,我最在意的不是某个模型又刷新了什么榜单,而是中国公司开始把力气使在「别人没那么愿意做」的地方,比如推理缓存、企业数字员工、无代码原生应用、教育动画生成、国际组织治理。这些都不是最容易出爆款 PR 的方向,但每一个都是真实痛点。

AI 的竞争正在从「谁模型更大」转向「谁能在真实场景里把成本压下去、把体验做上来」。这个转变,对国内团队来说,可能反而是个好机会。


如果你也关注中文AI赛道的真实进展,欢迎常来看看。有些东西,不追热点才看得清。