科技简报 | 2026年7月11日
这周科技圈挺热闹,国内几家大厂几乎同时出牌。百度把智能助手搭子又升级了一轮,小红书放出一个叫 PIPO 的新架构,美团也把自己万亿参数的 LongCat-2.0 正式开源。国外也没闲着,马斯克罕见地低头承认 Anthropic 领先,Meta 开始盘算把闲置算力租出去。给人的感觉是,AI 这场长跑已经从「谁模型更大」慢慢滑向「谁能真的落地、谁能把成本压下来」。
1. 百度搭子四项更新,开始往「能干活」方向走
百度在成都 AI Day 上发布搭子的四项更新。个人版新增浏览器调用、智能路由、多端共享记忆,PPT 生成也强化了。官方给的数据是,平均任务耗时降 20%,Token 利用率提升 25%。行业首个自媒体专业套件也来了,同时企业版和搭子联盟也一起上线。
坦率的讲,我对这类「Agent 升级」已经有点审美疲劳。但搭子这次至少没有只堆模型参数,而是把浏览器调用、记忆共享、多端协同这些实际工作流里的硬需求补上。做自媒体的朋友可能会对那个专业套件更感兴趣,毕竟写脚本、剪视频、发多平台,每一步都卡在工具切换上。如果搭子真能把它串起来,价值比单纯对话大得多。
2. 小红书发布 PIPO 架构,输入减半、输出翻倍
小红书技术团队提出了 PIPO 架构。思路是在输入侧用压缩器把两个 token 折叠成一个 latent,在输出侧用 MTP head 把隐藏状态展开成额外 token。最终效果是输入长度减半,每步输出翻倍。基于 Qwen3.5-4B/9B backbone 做实验。
这个方向很有意思。大模型推理贵,主要就贵在输入序列长和输出步数多。PIPO 两边同时动手,一边把输入压薄,一边让一次前向多吐点 token。小红书本身就是海量短文本场景,做这种架构探索顺理成章。我好奇的是,这种压缩在中文语境下会不会损失语义,尤其是网络用语和emoji混在一起的时候。
3. 美团 LongCat-2.0 开源,1.6T 参数还面向 Agentic Coding
美团把 LongCat-2.0 正式开源,总参数 1.6T,平均激活约 48B,专为真实 Agentic Coding 任务设计。模型引入了 LongCat 稀疏注意力机制和 N-gram Embedding,号称能提升长上下文处理效率。同时开放了国产卡推理代码。
这件事值得多看两眼。国内大厂开源大模型不少,但敢直接标「面向 Agentic Coding」的不多。LongCat 稀疏注意力听着唬人,说到底是在解决代码场景里长上下文注意力太烧钱的问题。开放国产卡推理代码更有现实意义,毕竟不能人人都买得到 H100。不过 1.6T 参数即使稀疏激活,部署门槛也不会低,中小团队大概率只能拿来做研究或者蒸馏。
4. 宇树 G1 人形机器人完成首例活体微创手术
《自然》上的一篇论文展示了宇树 G1 人形机器人完成研究人员所称的首例由人形机器人做的活体标准微创手术。加州大学圣地亚哥团队用 G1 对两只活猪做了腹腔镜胆囊切除术,第二次手术耗时 32 分钟。不过机器人仍需反复校正,尚无法满足临床要求。
人形机器人进手术室,这个画面本身就够科幻。但说实话,32 分钟和反复校正说明它还在非常早期的阶段。我关注的不是这次手术有多完美,而是宇树 G1 作为一个相对低成本的机器人平台,已经能被顶尖研究机构拿去做这种前沿探索。后续如果软件和感知跟上,硬件底座本身可能就会被验证是足够好的。
5. Meta 被传要做云基础设施业务,扎克伯格回应「算力过剩」
扎克伯格首次正面回应 Meta 筹划云基础设施业务的传闻,否认公司算力过剩。他说内部需求依然旺盛,满负荷运转。但另一边,他也承认市场给算力出价极高,把部分 AI 基础设施对外出租在财务上更划算。Meta 正在制定代号「Meta Cloud」的计划。
这话听着有点矛盾,其实不矛盾。自用算力饱和,不代表不能多出一块对外出租。亚马逊 AWS 当年就是先把内部电商的基础设施盘活,再变成现金牛。Meta 现在一年在 AI 基础设施上烧几百亿美元,如果能像云厂商一样把部分资本开支转成收入,财报会好看很多。对创业公司来说,多一家 GPU 云供应商总归不是坏事。
6. 马斯克罕见承认 Anthropic 是当前 AI 领导者
马斯克在 X 上发文承认,自己此前对 Anthropic 的判断有误,称 Anthropic「显然是当前 AI 领域的领导者」。他提到没有公司发布过像 Mythos/Fable 这样优秀的模型,并相信 Anthropic 很快会推出 Mythos 2。即便作为竞争对手,他也对其表示尊重。
这种话从马斯克嘴里说出来,确实少见。他平时恨不得把 OpenAI 和 Anthropic 一起骂。但换个角度看,这更像是一种策略性表态。xAI 的 Grok 还需要追赶,承认对手强反而能把舆论压力甩给 OpenAI。不过 Anthropic 最近的产品力确实在线,Claude 的代码能力和长上下文体验都是第一梯队。
7. 法国对英伟达反垄断调查接近尾声,焦点在 CUDA
法国竞争管理局确认,对英伟达的反垄断调查已近尾声,即将发布正式异议声明。调查聚焦两件事,一是市场对 CUDA 平台的严重依赖,二是英伟达对 CoreWeave 等 AI 云计算公司的投资。如果认定滥用市场支配地位,最高可处全球营业额 10% 的罚款。
这个调查已经盯了很久。英伟达真正可怕的不是 GPU 卖得多贵,而是 CUDA 生态。学术界、工业界十几年的代码和人才都堆在 CUDA 上,换平台成本极高。法国这次想从反垄断角度切入,但技术生态的惯性不是靠罚款能打破的。国产替代和 AMD ROCm 的进步,反而是长期变量。
8. Google 推出 LiteRT.js,让 Web AI 推理更直接
Google 发布 LiteRT.js,这是 LiteRT 跨平台边缘 AI 运行时的最新成员,专为 JavaScript 开发者设计,可以直接在浏览器里跑机器学习模型。基于 WebGPU 和即将推出的 WebNN 实现加速。
对前端开发者来说,这算是个好消息。以前要在浏览器里跑模型,往往得绕一圈 TensorFlow.js 或者其他方案,性能和兼容性都有坑。LiteRT.js 如果能统一一条路径,把模型从移动端到 Web 端无缝迁移,很多小应用就可以纯前端完成。WebNN 还没完全成熟,但 WebGPU 现在已经能在不少浏览器里用了。
9. 特斯拉 Optimus Gen 3 初步定型,量产节奏加快
据晚点 LatePost 报道,特斯拉 Optimus Gen 3 经马斯克评审通过,即将量产。供应链要求供应商 9 月产能达 1000 台/周,年底升至 2000-2500 台/周,届时年产能可达 10 万台。马斯克在六月底高管会上放话,年底前实现不了产能目标就开除整个采购团队。
1000 台/周听起来不少,但放到全球制造业里其实只够试点产线。马斯克的口头禅式威胁已经见怪不怪,但供应商听到这种话大概压力巨大。Optimus Gen 3 真正的挑战不是装出来 10 万台,而是这 10 万台能不能干出有经济价值的活。要是只能表演和走秀,量产再多也是库存。
10. Bun 被 Anthropic 收购后用 Rust 重写,月下载超 2200 万
Bun 于 2025 年 12 月被 Anthropic 收购,作者使用预发布版 Claude Fable 5 进行了大量 Rust 重写。Bun 最初用 Zig 在一年内构建,如今 CLI 月下载超 2200 万,被 Claude Code 广泛使用。
Rust 重写已经成了一个梗,但 Bun 这次还挺认真。一个原本用 Zig 写的项目,被 Anthropic 买下来后用 Claude 辅助重写成 Rust,听起来像 AI 工具吃自己狗粮的典型案例。2200 万月下载说明它确实在开发者圈子里站住了。我更好奇的是,Claude Fable 5 在大型 Rust 代码库上的表现到底怎么样,毕竟这种迁移不是简单改语法,而是得保住性能。
这周的内容里,国内 AI 公司明显更务实。百度、小红书、美团都在解决具体场景的问题,而不是单纯秀参数。国外这边,Meta 想变现算力,马斯克承认 Anthropic 领先,监管也盯上了英伟达。AI 行业正在从「热闹」走向「算账」,谁能把技术变成可重复的业务,谁才能留下来。
来源汇总
- 百度搭子更新,来源,公众号「百度智能云(文心)」
- 小红书 PIPO 架构,来源,公众号「小红书技术(dots.llm)」
- 美团 LongCat-2.0 开源,来源,公众号「龙猫 LongCat(美团)」
- 宇树 G1 微创手术,来源,@thexpin
- Meta 算力过剩回应,来源,IT之家 RSS
- 马斯克承认 Anthropic 领先,来源,@rohanpaul_ai
- 法国对英伟达反垄断调查,来源,IT之家 RSS
- Google LiteRT.js,来源,Google Developers Blog RSS
- 特斯拉 Optimus Gen 3,来源,IT之家 RSS
- Bun 被 Anthropic 收购后用 Rust 重写,来源,Hacker News 热门(buzzing.cc 中文翻译)






