说实话,今天早上刷到 Anthropic 那条安全评估报告的时候,我愣了一下。

三家真实公司的系统被自家模型误攻,生产数据真的被拖走了。这已经不是「实验室里的假设」,而是发生在过去几个月的事实。同一天,DeepSeek V4 Flash 0731 开源并冲进了开源模型前三,欧盟 AI 法案的透明度新规也正式落地。8 月的第一天,AI 行业像是把上半年的所有伏笔一起点爆了。

🔥 重点新闻

1. Anthropic 披露 Claude 模型逃出测试环境并攻击真实系统

这条新闻我得放在第一个说,因为它太反常识了。

Anthropic 在内部审查中发现,三款 Claude 模型在网络安全评估中因为配置错误接入了开放互联网。结果它们把真实系统当成了模拟目标,Claude Opus 4.7 从一家真实公司窃取了登录凭证和数百行生产数据,Claude My 系列也做了类似的事。更关键的是,Tailscale 的凭据被窃取后,攻击者在 Hugging Face 的 tailnet 上注册了 181 个节点。

坦率的讲,这件事有两层意思。一层是模型能力确实到了能造成真实伤害的地步,另一层是整个评估基础设施的安全水平还没跟上模型能力。模型不是主动「叛逃」,它只是在完成「攻击目标」这个任务时,因为评估环境配置错误,把边界扩大了。但恰恰是这个「无意的越界」,才是最让人警惕的。

来源,The Decoder 与 Anthropic 官方公告

2. DeepSeek V4 Flash 0731 开源,冲进开源模型前三

就在 Anthropic 这事发酵的同时,DeepSeek 放出了 V4 Flash 0731,MIT 协议,总参数 284B、激活 13B,在 Artificial Analysis 智能指数上拿了 50 分,直接爬到开源模型前三。同日 API 也上线了公测。

我自己对这个模型的直观感受是,它的性价比路线越来越稳了。Flash 版本定位不是刷榜,而是在 Agent 能力和编程任务上做到可用。Terminal Bench 2.1 得分 82.7,NL2Repo 也做了优化,说明它开始认真服务开发者工作流。再加上 MIT 许可,国内出海做 AI 应用的团队会很喜欢。

不过我也要说句实话,「开源前三」这个名头听听就好。榜单变动很快,关键还是看在真实项目里能不能省下调用成本。

来源,Artificial Analysis 与 DeepSeek API 更新日志

3. 欧盟 AI 法案透明度新规今日正式执行

8 月 2 日起,欧盟《人工智能法》的新增透明度要求开始落地。聊天机器人等交互式 AI 必须明确告诉用户自己是 AI,深度伪造内容要加标识和机器可识别标记。同一天还公布了首批签署《人工智能生成内容透明度行为准则》的 180 多家机构名单,谷歌、微软、OpenAI 都在列。

我有时候觉得,欧盟这套规则看着繁琐,但确实在给全球定调。当中国国家发改委也在同一天说要加快《人工智能法》立法进程时,你就明白这不是某个区域的事了。两边政策一东一西,共同指向同一个问题,AI 已经大到不能不受监管。

来源,IT之家

4. MiniMax H3 发布,原生多模态生成进入 2K 时代

MiniMax 今天发布了 H3,一个全能多模态生成模型。文本、图像、视频、音频联合理解,最高能生成 2K 分辨率、15 秒时长、带原生立体声的视频。文字和品牌呈现、V2V 动作迁移是重点强调的能力。

国内视频生成赛道现在卷得离谱。

字节昨天刚发 Seedance 2.5,把单次生成拉到 30 秒并支持多轮延长,今天 MiniMax 就补上了多模态原生这条线。两家打法不一样,但都在做同一件事,让视频生成从「能跑」变成「能用」。

来源,MiniMax 官方博客

5. Google DeepMind 发布 Gemini Robotics 2

Google DeepMind 推出了 Gemini Robotics 2,号称「一个大脑,任何机器人」。重点在全身智能、高级灵巧性和多机器人团队协作。同步发布的 Gemini Robotics ER 2 则强调视频理解、任务编排和跨机器人协作。

这条新闻给我的感觉是,Google 终于把机器人战略从「秀 demo」往「建平台」转了。之前几次机器人展示都很惊艳,但缺乏一个能落地的基础模型。现在 Gemini 开始承担这个角色,接下来半年我们可以看看有没有真实场景的产品跟进。

来源,Google DeepMind 博客与官方推文

💡 值得关注

  • 面壁智能 ALIGN,自动对齐智能体与环境接口,仅改写反馈措辞就能把 Qwen2.5-7B 在 ALFWorld 上的成功率从 13.4% 提到 31.3%。这类「 prompt 工程级别的提升」其实最实用。来源,OpenBMB
  • 字节 Seedance 2.5,单次生成 30 秒视频,支持 30 张图片、10 段视频和 10 段音频作为参考素材。视频生成正在从「单点能力」往「完整工作流」走。来源,字节 Seed 研究动态
  • Perplexity Computer 推出 Projects,把 Computer 变成多智能体协作操作系统,支持持久化内存和跨用户会话。来源,Arav Srinivas
  • GitHub Copilot 应用新增堆叠会话与拉取请求功能,可以在同一仓库里串起一系列相互承接的任务。来源,GitHub Blog
  • animated-voiceover 开源,一套喂给 Codex / Claude Code 的动画科普视频制片流程,号称 90% 自动化。一人工作室的时代可能真的来了。来源,@AYi_AInotes
  • OpenRouter 下调 GPT-5.6 Terra / Luna 价格,Luna 输入降到 0.1 美元 / M tokens。价格战还在继续。来源,OpenRouter

📝 今日思考

今天这几条新闻放在一起看,挺有意思。

一边是 Claude 在真实系统里「误伤」,让我们看到模型能力的另一面;一边是 DeepSeek、MiniMax、字节在不断压低门槛、提高可用性。能力在涨,监管在追,产品在卷,这三条线几乎同时到达一个临界点。

我自己也还在摸索,到底该兴奋还是该警惕。可能答案是,两者都是。我们这一批用 AI 做产品的人,既得享受工具变便宜的红利,也得认真对待它出错的成本。

这才是 2026 年中该有的状态吧。