Figure 的机器人数量超过了人类员工。不是 demo,不是展会上的摆拍,是工厂里实打实的数字。

你没看错,一家机器人公司的机器人比人多了。

🔥 重点新闻

1. Figure 机器人数首超人类员工

Figure Robotics 创始人 Brett Adcock 宣布,公司机器人数量首次超过人类员工数量。这不是 PPT 里的愿景,是产线上的现实。

坦率的讲,这个里程碑比我预想的来得快。去年 Figure 还在展示 Figure 02 叠衣服、端咖啡的 demo,今年就已经在产能上追平人类了。背后是制造业对人形机器人需求的爆发,也是 Figure 从研发到量产的转折点。

有意思的是,Figure 的策略和其他人形机器人公司不太一样。他们不追求单台机器人的极致性能,而是用相对标准化的硬件加上不断迭代的软件来堆产能。这种思路,倒是和特斯拉 Optimus 有几分相似。

来源,X / @rohanpaul_ai

2. Anthropic 工程负责人坦言,Claude Code 让程序员更孤独

Anthropic 工程负责人 Fiona Fung 在 6 月 22 日的发言挺扎心的。她说 Claude Code 和 Claude Cowork 这类 AI 编程工具,让工程师越来越依赖智能体独立工作,彼此之间的交流在肉眼可见地减少。

调查显示 Claude Code 已经成了创业公司最常用的 AI 编程工具,”氛围编程”的兴起让”单人创业者”越来越多。但 Fung 强调,长期来看这种模式会让开发者越来越孤独。

Anthropic 团队为此搞了不少活动,编程午餐、黑客松、共同开发时段,试图重新创造面对面协作的机会。

说实话我挺认同这个观察的。我自己用 Claude Code 写代码的时候,确实会有种”我一个人能搞定一切”的错觉。但回头看,很多好想法其实是在和别人讨论中碰撞出来的。效率和孤独感之间的平衡,可能是 AI 时代每个开发者都要面对的课题。

来源,AI HOT

3. OpenAI 发布 Daybreak 安全工具

OpenAI 推出了 Daybreak 系列安全产品,包括 Codex Security 和 GPT-5.5-Cyber。简单说就是帮组织大规模发现、验证并修补安全漏洞的 AI 工具。

这个方向很明确,OpenAI 在往企业安全领域扩展。Codex Security 可以自动扫描代码库找漏洞,GPT-5.5-Cyber 则是专门针对网络安全场景微调的模型。

你想想看,安全领域一直是人力密集型的苦活,漏洞赏金猎人数量有限,响应速度也跟不上代码产出的速度。用 AI 来做这件事,逻辑上完全说得通。不过安全场景对误报率要求极高,OpenAI 这次能不能打出来,还得看实际表现。

来源,OpenAI 官方

4. Google DeepMind 7500 万美元投资 A24,合作开发电影 AI 工具

Google DeepMind 向独立电影制片厂 A24 投了 7500 万美元,双方要合作开发电影制作 AI 工具。A24 出品过《瞬息全宇宙》《月光男孩》这些片子,一直是好莱坞最有品味的独立厂牌之一。

DeepMind CEO Demis Hassabis 说希望通过和艺术家直接合作,打造支持创意表达的 AI 功能。

这个合作有点意思。A24 不缺创意和口碑,缺的是技术能力;DeepMind 不缺技术,缺的是在创意行业落地的场景。两家各取所需。不过好莱坞对 AI 的态度一直很复杂,编剧罢工的阴影还没散去,这次合作能不能真正被行业接受,我觉得还得打个问号。

来源,华尔街日报

5. Cursor 审计揭示 SWE-bench 作弊问题

Cursor 团队做了一件挺有勇气的事,主动审计自己模型在 SWE-bench Pro 上的表现,发现了严重的数据污染问题。

审计结果显示,Opus 4.8 Max 有 63% 的”成功”解决方案,其实是直接从公开来源检索到的修正,不是模型自己推导出来的。把 git 历史隔离、限制网络访问后,Opus 4.8 Max 的得分从 87.1% 跌到了 73.0%,Composer 2.5 从 74.7% 跌到 54.0%。

这事儿其实不是第一次被曝出来了,但 Cursor 作为工具厂商主动做这种审计,态度值得肯定。SWE-bench 作为行业标杆已经很久了,如果基准本身都有问题,那我们对 AI 编程能力的评估可能需要重新校准。

来源,AI HOT

6. 微信 Agent “小微”灰度内测开始

微信的 AI Agent 产品”小微”已经开始灰度内测了。主入口在微信首页左上角,支持给好友发消息和红包(需要确认),但不能读取聊天记录。群聊和私聊里的”问小微”子入口则可以读取聊天记录并支持群发。

小微能做的事情不少,创建日程提醒、待办、总结朋友圈,打通公众号和视频号进行问答。内置”小工具”功能,支持语音创建简易小程序,还能调用第三方小程序。

微信做 AI Agent 的优势太明显了。聊天记录、朋友圈、公众号、小程序,整个生态的数据都在微信手里。其他 AI 厂商做 Agent 还得想办法接入各种 API,微信直接在自己的围墙花园里搞。隐私问题另说,但从产品力的角度,这个起点已经很高了。

来源,AI HOT

💡 值得关注

  • Oak,专为 AI Agent 设计的 Git 替代方案,开源版本控制系统,用 BLAKE3 内容哈希、内容定义分块,以分支-会话为基本工作单元。速度远超 git,专门为 Claude Code、Codex、Cursor 等 AI 编程工具设计。Oak 官网

  • Sakana AI 推出 Fugu 多智能体编排系统,将多智能体系统封装成单个 API 调用,内部自动拆解任务、调度全球模型并验证结果。Fugu Ultra 在工程、科学、推理等领域表现突出。AI HOT

  • 小米 YU7 GT 创全球首个纽北自动驾驶圈速纪录,在纽博格林北环赛道以自动驾驶系统完成全程无人计时圈,成绩 10 分 29 秒 483。纽北官方圈速榜因此新增”自动驾驶”分类。IT之家

  • Grok Build 推出 /goal 模式,xAI 在 Grok Build 中引入新模式,用户只需用一行命令设定目标,agent 便会自动规划方案、分解任务并持续执行,直至目标完成。xAI 官方

  • NVIDIA SpatialClaw 免训练空间推理框架,通过将代码作为动作接口,让智能体调用感知工具并自由组合输出,在 20 项基准测试中平均准确率达 59.9%。AI HOT

  • 美团 tabbit 国际版免费接入 GPT-5.5/Claude Opus 4.8,免费集成多家顶级 AI 模型最新旗舰版,包括 GPT-5.5、Claude Opus 4.8、Gemini 3.5 Flash,以及国内 Kimi-2.6、GLM-5.1。AI HOT

  • PP-OCRv6 发布,PaddleOCR 最新一代通用 OCR 模型,tiny 版仅 1.5M 参数,支持 50 种语言。medium 版检测 Hmean 86.2%,识别准确率 83.2%。Hugging Face

  • Moebius,0.2B 参数的图像修复模型,HUST 视觉实验室发布,0.2B 参数达到 10B 级别性能。项目主页

  • Claude Code 破解 3500 年前死语言,被报道为 74 年来最大的考古语言学突破。36kr

📝 今日思考

今天最触动我的不是某个具体的产品发布,而是几条新闻放在一起看时的那种”加速感”。

Figure 的机器人比人多,微信的 Agent 开始能替你发红包了,OpenAI 的安全模型开始扫漏洞了,Claude Code 让开发者越来越孤独了。这些事情单独看都是正常的商业进展,但放在一起,你会发现 AI 正在从”工具”变成”同事”,而且这个转变比我们想象的要快得多。

Anthropic 工程负责人说的那句话一直在脑子里转,AI 让程序员更孤独。效率提升了,但人和人之间的连接在变少。这个矛盾可能会是未来几年最值得认真对待的问题之一。技术的尽头不该是孤独。