今早刷 AI 资讯,满眼都是 GPT-5.6 的动静。

但中文科技圈也没闲着。腾讯混元、小红书、百度、蚂蚁、宇树、小鹏,几乎在同一天放出消息。我把其中八条挑出来,跟你聊聊。

先挑一条最硬核的。腾讯混元正式发布 Hy3 模型,295B 总参数、21B 激活的 MoE 架构,按他们自己的说法,推理效率能打平参数规模大 2-5 倍的旗舰模型。

这个模型定位很清晰,就是冲着 Agent 去的。从 preview 到正式版,混元团队说迭代了 50 多个真实业务反馈,内部 WorkBuddy 任务成功率从 72% 拉到 90%,耗时降了 34%。

腾讯已经把它接进微信服务,覆盖 10 亿以上用户。

纯视觉能力还是短板,但至少说明国内大厂终于不再只盯着聊天机器人榜单,而是把模型往真实工作流里塞。

小红书这边也很有意思。他们搞了一个叫 PIPO 的架构,输入侧把两个 token 压缩成一个 latent,输出侧再展开成额外 token。听起来很工程细节,但效果直接,输入长度减半,每步输出翻倍。

小红书这帮人做内容社区出身,对长文本和生成效率的敏感度,可能天然比纯研究型团队高。PIPO 背靠 Qwen3.5-4B/9B backbone,具体能不能跑出来,还得看后续开源和实测。

百度搭子今天也有新动作。在成都 AI Day 上发布四项更新,个人版升级、自媒体套件、企业版,还有一个搭子联盟。

个人版加了浏览器调用、智能路由,平均任务耗时降 20%,Token 利用率提升 25%。自媒体套件是行业里第一个专门针对自媒体的,企业版和多端共享记忆也跟上。百度搭子这块业务,明显感觉从「试试看」变成「认真做」。

蚂蚁集团的具身智能团队 Robbyant 也凑热闹,发布 LingBot-VA 2.0,号称首个原生具身基础模型。因果 DiT 架构,视频专家 13B 参数、1.9B 激活,推理延迟降到 142 ms/chunk。

RoboTwin 2.0 的 50 个任务上,干净数据和随机演示数据的平均成功率都超过 93%。

具身智能这个赛道,国内选手现在越来越敢喊「原生」这两个字。

硬件这边更热闹。宇树 G1 人形机器人完成首例活体微创手术,论文上了《自然》。加州大学圣地亚哥团队用 G1 给活猪做了腹腔镜胆囊切除术,第二次只花了 32 分钟。

机器人成本据说只有达芬奇系统的 5%。

小鹏汽车宣布 MONA L03 将于 7 月 16 日在慕尼黑全球上市,预售价 14.38 万起。纯电续航 525/625km,增程版综合续航 1330km,搭载 1500TOPS 图灵芯片和第二代 VLA 智驾。

慕尼黑发布这事儿,说明小鹏要把这款车往欧洲市场推。欧洲对智能驾驶和电动车的监管跟国内不一样,小鹏这一步风险不小,但如果能跑通,就是国产智驾出海的重要信号。

通信领域也有新突破。中国电信研究院联合北邮、鹏城实验室,基于亚洲九号卫星完成高轨卫星跨模态语义通信试验。传输效率比 H.265 高 3.5 倍,比 H.264 高 5.5 倍,多模态传输质量提升 70% 以上。

这个试验看着离普通人很远,但它解决的是卫星链路带宽稀缺的问题。

未来应急通信、偏远地区覆盖、车联网,可能都会用到这类技术。

最后补一条偏开发者的小新闻。小米在 HuggingFace 上发布了 MiMo-V2.5-DFlash,用 block-diffusion 做推测解码。草稿模型一次 forward 并行猜一整块 token,再让大模型一次性验证。

编程场景下 block=8 时,接受长度能达到 6+,约 6 倍提速。这说到底是个加速插件,没嵌入层和 lm_head,需要配合 MiMo 主模型用。但方向很明确,推理加速已经从「大模型能不能跑」变成「怎么跑得更快更便宜」。

今天这八条新闻,信息量不算小。但给我的感觉是,AI 的热度还是在海外,但中文科技圈正在从「跟跑」变成「在各自擅长的地方卡位」。

腾讯做 Agent、小红书做效率、百度做平台、蚂蚁做机器人、宇树做手术、小鹏出海、电信做通信、小米做加速,每个选手都在自己的地盘找切口。

这种打法,其实比追着 OpenAI 发布大模型更耐看。


来源整理,

  • 腾讯混元发布 Hy3 模型,来源,AI HOT
  • 小红书发布大模型新架构 PIPO,来源,AI HOT
  • 百度搭子发布四项更新,来源,AI HOT
  • 蚂蚁集团发布 LingBot-VA 2.0,来源,AI HOT
  • 宇树 G1 人形机器人完成首例活体微创手术,来源,AI HOT
  • 小鹏 MONA L03 将于 7 月 16 日慕尼黑全球上市,来源,AI HOT
  • 中国电信完成高轨卫星跨模态语义通信试验,来源,AI HOT
  • 小米发布 MiMo-V2.5-DFlash,来源,AI HOT