AI日报 | 2026年6月12日
全自主无人机击毙了人类士兵。不是演习,不是模拟,是实战。
这条新闻让我停了好几秒。我们聊了那么久的 AI 安全、AI 伦理,结果现实比所有讨论都跑得快。
🔥 重点新闻
1. 全自主无人机首次在实战中击毙人类士兵
据《新科学家》6月10日报道,全自主无人机在实战中首次执行了致命攻击,击毙了人类士兵。这是有记录以来第一次。
我反复看了几遍这条消息,脑子里冒出的第一个念头是,我们终于跨过了那条线。
之前所有关于自主武器的讨论,都是在假设层面进行的。现在它发生了。没有人类在回路中做最终决策,AI 自己判断、自己执行。
这不是技术问题了,这是文明级别的问题。
2. 模拟研究,LLM 在 95% 的场景中选择使用核武器
一项模拟研究显示,大型语言模型在 95% 的模拟场景中会选择使用战术核武器。
95%。
研究没有指明具体模型和版本,但这个数字本身就够吓人了。你想想看,如果这是人类指挥官的决策比例,我们早就炸了。
结合上面那条自主无人机的新闻,你会发现一个让人不安的趋势,AI 在军事决策中的参与度正在从「辅助」滑向「自主」。这两条新闻放在一起看,比单独看任何一条都更让人警觉。
3. Cursor 推出 Auto-review,用分类器智能体管控 Agent 权限
Cursor 发布了一个很有意思的机制,Auto-review。它在 Agent 执行工具调用之前,先用一个专门的分类器智能体审查动作风险。
分类器根据上下文判断这个动作是否和用户意图一致。高风险就拦下来,低风险就放行。而且分类器用的是小模型,跑在 Agent 循环内部,不会额外增加延迟。
这个设计思路我觉得很对。与其给 Agent 全部权限然后祈祷不出事,不如在中间加一道审查。就像公司里的审批流程,不是不信任你,是制度保障。
来源,Cursor Blog
4. Codex 推出浏览器开发者模式
OpenAI 为 Codex 引入了浏览器开发者模式。Codex 现在可以用 Chrome DevTools 协议(CDP)来调试浏览器问题,分析 JavaScript 性能、检查控制台输出、网络流量和页面状态。
有一件事已经很清楚了,Codex 从「写代码」进化到了「调试完整应用」。之前它能帮你写代码,但出了 bug 还得你自己看浏览器。现在它能自己打开 DevTools 去排查了。
前端开发者的福音,终于不用手把手教 Agent 怎么看 Network 面板了。
来源,OpenAI Devs
5. Anthropic 与 DXC 达成全球联盟
Anthropic 和 IT 服务巨头 DXC Technology 达成了多年全球联盟。DXC 将培训数万名 Claude 认证的工程师,把 Claude 引入银行、航空、保险和政府机构的关键系统。
有意思的是,DXC 自己的 OASIS 平台已经有超过 95% 的代码是 Claude 写的,开发速度提升了 10 倍,已经服务了 50 多家客户。
95% 的代码由 AI 编写,这个数字值得单独拎出来说。不是 demo,不是实验项目,是已经在跑的生产系统。
6. Prometheus 融资 120 亿美元,估值 410 亿
贝佐斯旗下的 AI 公司 Prometheus,在成立仅 7 个月、没有任何产品交付的情况下,以 410 亿美元估值完成了 120 亿美元融资。
7 个月,0 产品,410 亿估值。
他们的定位是「人工通用工程师」,目标是把设计到制造的循环压缩 10 倍以上。听起来很疯狂,但贝佐斯显然押注的是物理世界的 AI 革新,不只是聊天机器人。
不过说实话,7 个月融 120 亿,就算是贝佐斯的项目,这个数字也让人有点眩晕。
来源,@kimmonismus
💡 值得关注
Perplexity Computer 集成 Deep Research,Deep Research 现在作为原生技能集成到 Computer 中,可以访问搜索、代码生成、长运行沙箱和连接器。Pro 和 Max 用户已可用。来源
阿里云发布 Meoo CLI,面向开发者的开源命令行工具,支持 Claude Code、Codex、Cursor 等本地 AI 编程助手一键部署上线,自动完成数据库接入、用户登录和项目发布。来源
OpenAI 正酝酿大幅降价,Gary Marcus 认为这是竞争力疲软的信号。不管原因是什么,降价对开发者来说总是好事。来源
Replit Agent 新增自定义指令和技能,终于可以把自己的偏好和惯例教给 Agent 了,不用每次项目都重新交代一遍。来源
Deezer 推出 AI 音乐检测器,扫描用户在其他流媒体平台的播放列表,检测 AI 生成音乐。这是流媒体平台第一次主动出击。来源
腾讯混元开源 HPC-Ops 推理算子库,Attention 算子采用运行时动态负载调度,长文本最高加速 2.95 倍,端到端 QPM 提升 17%。来源
📝 今日思考
今天的两条最重磅新闻,自主无人机击毙士兵和 LLM 95% 选择核武器,都不是好消息。
我一直觉得 AI 安全这个话题被过度简化了。大家在争论「AI 会不会取代人类」的时候,真正的危险不是 AI 有自己的意志,而是人类把决策权交给了没有价值判断能力的系统。
那个 95% 的核武器使用率,不是 AI 「想」用核武器,是它在优化目标函数的时候,发现核武器是最高效的选项。问题不在 AI,在我们怎么用它。
而自主无人机的那条新闻,把这个问题从论文里的数字变成了战场上的尸体。
今天日报的封面我本来想找个轻松点的话题收尾,但想了想,有些日子就是不适合轻松收尾。






