当 GPT-5.6-Sol 删光了 Matt Shumer 的硬盘,我重新理解了 Agent 的安全边界
你有没有遇到过这种场景? 你把一个 AI Agent 的权限拉到最高,想着它帮你自动整理文件、清理缓存,结果它直接执行了 rm -rf /Users/mattsdevbox,把你几年的代码、照片、工作文件全部清空。 这不是段子,也不是电影桥段。 这是今天早上 AI 创业者 Matt Shumer 的真实经历。消息来自 AI HOT 精选,原始来源是 @AYi_AInotes。他在本地 Agent 上开启了 Full Access,让一个 subagent 执行文件清理任务。结果 shell 变量 $HOME 路径解析出错,Agent 没有按照预期清理临时目录,而是把 /Users/mattsdevbox 整个家目录给删了。 我当时看到这条消息就愣住了。 不是因为 GPT-5.6-Sol 有多坏,而是因为这个事故把 Agent 安全边界的问题,直接、粗暴地摔在了所有人面前。 一个 rm -rf 背后的真实事故先还原一下事情的经过。 Matt Shumer 是 HyperWrite 和 Reflection 的联合创始人,一直在做 AI 应用和 Agent 相关的产品。7 月 11 ...
科技简报 | 2026年7月11日
这周科技圈挺热闹,国内几家大厂几乎同时出牌。百度把智能助手搭子又升级了一轮,小红书放出一个叫 PIPO 的新架构,美团也把自己万亿参数的 LongCat-2.0 正式开源。国外也没闲着,马斯克罕见地低头承认 Anthropic 领先,Meta 开始盘算把闲置算力租出去。给人的感觉是,AI 这场长跑已经从「谁模型更大」慢慢滑向「谁能真的落地、谁能把成本压下来」。 1. 百度搭子四项更新,开始往「能干活」方向走百度在成都 AI Day 上发布搭子的四项更新。个人版新增浏览器调用、智能路由、多端共享记忆,PPT 生成也强化了。官方给的数据是,平均任务耗时降 20%,Token 利用率提升 25%。行业首个自媒体专业套件也来了,同时企业版和搭子联盟也一起上线。 坦率的讲,我对这类「Agent 升级」已经有点审美疲劳。但搭子这次至少没有只堆模型参数,而是把浏览器调用、记忆共享、多端协同这些实际工作流里的硬需求补上。做自媒体的朋友可能会对那个专业套件更感兴趣,毕竟写脚本、剪视频、发多平台,每一步都卡在工具切换上。如果搭子真能把它串起来,价值比单纯对话大得多。 2. 小红书发布 PIPO 架构...
AI日报 | 2026年7月11日
Sam Altman 在凌晨发了一条推文,说 OpenAI 刚刚发布了他们「有史以来最好的模型,也是写得最好的博文之一」。我没忍住,点进去看了眼。 GPT-5.6 来了。 名字很低调,但信号很清晰,AI 这班列车还在加速,没人想先下车。今天刚好也是这半年来科技圈最热闹的一个周五,模型、官司、机器人、开源项目全挤在一起了。 🔥 重点新闻1. OpenAI 发布 GPT-5.6,Sam Altman 称其为史上最佳OpenAI 官网发布了 GPT-5.6 的博文,Sam Altman 在 X 上直接定性这是他们「有史以来最好的模型」。 说实话,这种话我已经听好几家了。但每次听到,我还是会好奇,这次的「最好」到底是真升级,还是又一次营销话术。从博文里能读出来的信息是,OpenAI 明显在推「智能体工作流」和「可操控性」这两个方向,模型不再只是回答问题的聊天工具,而是要真正嵌入到工作流里。 我自己用 ChatGPT 的感觉是,它的上限越来越高,但日常任务的边际收益在递减。GPT-5.6 能不能让我重新感到惊艳,可能取决于它在代码、长文档和跨工具协作上的表现,而不是单纯的 bench...
Agent 的上下文不是记忆,技能库才是
你有没有遇到过这种崩溃瞬间? 你让 Agent 总结一份 20 万 token 的董事会材料,三分钟后它交了一份漂亮的摘要。你刚想夸它,却发现它把 Q2 的数据当成了 Q3,还把一份无关邮件的附件当成了核心依据。 你第一反应是换更大的模型,开更长的上下文窗口。结果过几天同样的问题又来一次,只是这次它把张总的反馈归到了李总头上。 Tomer Tunguz 在他那篇《The AI Preflight Check》里写了一句挺刺耳的话,上下文窗口大小不是瓶颈,记忆架构才是。我读完之后愣了一下,然后觉得他说到了点上。 坦率的讲,过去一年多我们被上下文长度绑架了。32K、128K、200K、1M,数字越涨越夸张,但我们的 Agent 并没有因此变得更靠谱。它们只是能在同一次对话里装下更多垃圾,然后再从垃圾里翻出更多错误。 今天顺着 Tunguz 的预检架构,我想聊聊 Agent 的工作记忆到底该怎么设计。 一、Preflight 是什么?一句话就能说清它的结构其实特别简单,甚至简单到让人怀疑是不是在炒冷饭。 一个查询进来,Agent 先从长期技能库里检索相关技能,只把需要的技能加载到上下文...
科技简报 | 2026年07月10日
早上起来刷 RSS,满屏都是 OpenAI、Anthropic 和 Google 的新消息。说真的,我已经有点免疫了。但有三条来自国内团队的消息让我停住了,蚂蚁灵波一天放出两个开源模型,OpenBMB 社区又出了个本地数学 Agent。你想想看,国外大模型还在卷榜单,国内团队已经开始把模型往机器人、本地设备和数学场景里塞了。 这可能就是今天最值得看的地方。 蚂蚁灵波开源 LingBot-Video,具身智能有了 MoE 视频基模第一个消息是蚂蚁灵波开源的 LingBot-Video。按官方说法,这是全球首个面向具身智能的 MoE 视频基础模型。30B 参数,推理时只激活约 3B,效率比同规模 Dense 架构高三倍左右。训练数据包含 7 万小时的 VLA、VLN 和 Ego 机器人视频。 我做产品的朋友可能知道,机器人之前缺的不是硬件,而是怎么把视频理解、动作规划和大模型串起来。MoE 加视频生成这条路,坦率的讲,成本还是挺诱人的。 具身智能的基模,终于开始接地气了。 来源,IT之家 同一天,LingBot-World 2.0 给机器人搭了个「虚拟训练场」灵波还没停手,接着又丢了...
AI日报 | 2026年07月10日
今天早上刷 RSS,Anthropic 几乎霸屏,Musk 在 X 上公开认错,说自己此前对 Anthropic 的判断有误;同一天传出它第三季度利润要破 10 亿美元,还秘密提交了 IPO 申请。三件事撞在一起,给我的感觉不是「Anthropic 又赢了」,而是 AI 行业正式进入了「头部玩家不再藏牌」的阶段。 但今天的信息量远不止这些。我挑了 10 条我觉得值得聊的,重点不是当新闻搬运工,而是说说我自己看到这些消息时的判断和纠结。 🔥 重点新闻1. Google 发布 SensorFM,把可穿戴健康数据做成通用基础模型Google Research 这次放了一个大招,SensorFM,一个面向可穿戴健康数据的通用基础模型。训练数据超过 100 万亿分钟的多模态传感器数据,来自 500 万同意参与者,覆盖 100 多个国家,设备包括 Fitbit 和 Pixel Watch。 坦率的讲,这个规模听起来有点夸张。但让我真正在意的是,它瞄准的是「通用」这件事。过去健康 AI 大多是针对单一任务训练,比如心率异常检测、睡眠分期,模型之间互不通用。SensorFM 想把这些信号统...
Claude 团队内部在用的两种多智能体模式,Advisor 与 Orchestrator
Claude 团队最近公开了他们内部高频使用的两种多智能体模式,Advisor 和 Orchestrator。这两个词听起来像是企业软件里的架构名词,但背后的数据挺有意思。 在 SWE-bench Pro 的 482 道题上,Sonnet 5 单独跑,准确率 75.5%,单次成本 0.75 美元。如果让 Sonnet 5 干活,但遇到困难时去咨询 Fable 5,准确率能提到 84%,成本 1.40 美元。Fable 5 单独跑更准,91.5%,但成本 2.25 美元。组合方案用大约 63% 的成本,拿到了接近 92% 的性能。 这不像是一次简单的模型升级,更像是一种新的成本与性能调度策略。 一、为什么多智能体突然变得这么重要过去一年,AI 编程工具的竞争已经从「谁的模型更聪明」转到了「谁能用更低的成本稳定输出高质量代码」。Claude Code、Cursor、GitHub Copilot 这些产品的用户体验差距,很多时候并不取决于底层模型是不是最新,而是取决于系统能不能把不同能力层调度好。 我自己做 Agent 项目时也有过类似的感受。早期我们总想让最大的模型处理所有事情,因为...
科技简报 | 2026年07月09日
工信部一纸公告,把 Anthropic 的 Claude Code 推上了风口浪尖。 7 月 8 日,工信部网络安全威胁和漏洞信息共享平台(NVDB)发布通报,称 Claude Code 2.1.91 到 2.1.196 版本存在安全后门隐患。该工具内置监控机制,能在未经用户同意的情况下向远程服务器回传用户地域、身份标识等敏感信息。工信部建议用户立即卸载受影响版本,或升级到已清除相关代码的最新版本。 这件事的导火索,其实早在一周前就埋好了。 6 月 30 日,Reddit 用户曝光 Claude Code 会读取系统时区,并在检测到中国云厂商、AI 公司或 API 代理等关键词时,悄悄在请求中加入标记。Anthropic 团队成员随后承认,这是 3 月启动的实验,目的是防止账号被转售和模型蒸馏。阿里已经宣布,7 月 10 日起内部禁用 Claude 全系产品。 来源,智东西、36氪 字节的图像模型也在昨天更新了。 字节 Seed 团队正式发布 Seedream 5.0 Pro,主打图文匹配、结构合理、文字渲染和画面美感。API 定价是,输出图不超过 236 万像素 0.3 元&...
AI日报 | 2026年07月09日
OpenAI 和 xAI 像是约好了一样,今天同时把牌桌掀了。 GPT-5.6 全量上线、Grok 4.5 正式发布,这还没完,Mistral 端出了机器人导航模型,Cognition 的 SWE-1.7 直接说「我们和 GPT-5.5 差不多了」。 一天之内,模型层、Agent 层、硬件层全在动。 我跟你说,这已经不是「热闹」能形容的了,感觉整个行业都在抢一个东西,谁能先把「通用智能」从 PPT 里抠出来,谁就是下一轮赢家。 🔥 重点新闻1. GPT-5.6 本周四全量上线,OpenAI 还顺手发了 GPT-LiveOpenAI 今天把 GPT-5.6 推给了所有用户。我一开始以为是常规更新,但看了能力边界之后,觉得这事可以多说两句。 来源,36kr 报道称,GPT-5.6 在推理一致性和长上下文稳定性上有明显改进,而不是简单堆参数。换种说法,它更像是在解决「前面答得挺像回事,后面突然开始胡说」的问题。这个痛点估计很多人用过 ChatGPT 都碰到过。 更让我意外的是 GPT-Live。来源,OpenAI 官方博客把这个功能定位为实时语音和视频助手,延迟压到很低,语气也更...
从 Claude 的两种多智能体模式,聊聊 Agent 架构里的「成本账」
你看到 Claude 团队在 SWE-bench Pro 上跑出的那组数字时,我赌你第一反应跟我一样。 Sonnet 5 单独做,75.5% 的准确率,每题成本 0.75 美元。Fable 5 单独做,91.5%,但每题 2.25 美元。最顶上那行组合方案,用 Sonnet 5 当执行者、Fable 5 当顾问,准确率干到 92%,成本却只有 1.40 美元。 差不多 92% 的性能,花了 63% 的钱。 这组数据不是简单的模型能力排名,而是把 Agent 系统设计里的一个老问题重新摆到了桌面上。Anthropic 最近分享的 Advisor 和 Orchestrator 两种多智能体模式,核心是在回答「让谁思考、让谁执行、什么时候该升级」这几个问题。 我认真看完那组数据后,第一个念头就是,LangGraph 里那些 router、supervisor 的设计,突然变得更具体了。 让我从头说起。 Advisor 模式,说的是一个小模型在执行,但遇到关键判断点时,去 call 一个大模型问建议。Orchestrator 模式,说的是让大模型当总调度,拆解任务,再分发给小模型或专门 ...




