AI日报 | 2026年08月18日
早上刷 RSS,三条消息撞在一起,Cursor 被 SpaceX 正式收购,黄仁勋宣布给 OpenAI 建一座 AI 工厂,宇树科技明天就要登陆科创板。表面看是三件事,但它们指向同一个信号,AI 行业正在从实验室跑分切换到真金白银砸基建、砸生态、砸上市通道。 你有没有发现,2026 年的 AI 新闻越来越像科技行业的「财报季」? 🔥 重点新闻1. Cursor 被 SpaceX 收购,同时推出 Origin 代码托管前脚被 SpaceX 正式收购,后脚就向所有付费用户开放 Origin 代码托管的早期测试。Cursor 这一步很有意思,它不再只想做你的编辑器,而是想接管从写代码到存代码、管代码、团队协作的一整条链路。Origin 提供仓库、PR、代码浏览,还能和 GitHub 双向同步。 坦率的讲,SpaceX 的 GPU 集群是全球最大规模之一,Cursor 拿它训模型能把成本摊薄,长期来看开发者或许能用上更强、更便宜的模型。但我也有点担心,编辑器、模型、代码托管、算力全捆在一家公司手里,vendor lock-in 只会更严重。一旦 Cursor 的模型和托管深度绑定,...
Anthropic 多智能体实验 | 45 个 Agent 跑出的 266 个洞见
45 个智能体,2700 万 token,266 个漏洞。 这是我看到 Anthropic 这篇新研究时印象最深的一组数字。同一套代码库,让 45 个 Claude 实例组队审计,它们找到的漏洞数量是 21 个独立并行智能体的 12 倍还多。更离谱的是,两组结果只有 12 个重叠。 我当时就愣住了。不是因为数字本身,而是因为它推翻了一个我很久以来的默认假设,多智能体系统的价值主要在于并行加速。你看,LangGraph 里我们总爱在 supervisor 和 worker 之间画很多条线,图的就是同时跑多个任务。但 Anthropic 这个实验告诉我,真正拉开差距的,可能不是并发,而是智能体之间的协调。 不过先别急着下结论。我觉得这篇研究有意思的地方,不在于它证明协调更强,而在于它把多智能体研究从工具编排推进到了社会系统模拟。它问的是一个更底层的问题,当 AI 智能体开始在共享代码库、共享市场、共享基础设施里活动时,它们会自发形成什么样的组织形态?这些形态又会带来什么新的风险? 我花了一下午读完论文和实验细节,想跟你聊聊这里面最让我头皮发麻的三个发现,以及它们对我做 LangGra...
科技简报 | 2026年08月17日
早上刷 RSS 的时候,我有点恍惚。 通义千问、DeepSeek、智谱、小红书、蚂蚁,几乎在同一时间抛出新东西。开源模型的迭代速度已经不是按月算,而是按周、按天在往前拱。 今天这份简报就从这场「开源大爆炸」开始聊起。 通义千问开源 Qwen3.8 系列,27B 硬刚闭源 Plus阿里这次放出来的 Qwen3.8-27B 是个原生多模态稠密模型,只有 27B 参数,官方说已经全面超过 Qwen3.7-Plus。上下文拉到 262K,用 YaRN 能扩展到 1M tokens。 更狠的是 Qwen3.8-2.4T-A95B,2.4T 总参数、95B 激活参数,主打自主编码和端到端智能体执行。 坦率的讲,阿里这套开源打法越来越像「你闭源卖高价,我就把同等能力的东西免费放出来」。开发者当然是高兴的,但压力也传导给了所有闭源厂商。 来源,Alibaba_Qwen / SiliconFlowAI DeepSeek-V4-Pro 正式上线,Agent 能力大幅增强DeepSeek 这边也没闲着。V4-Pro 正式版已经在 APP、网页端和 API 同步上线,模型名直接就是 deeps...
AI日报 | 2026年08月17日
今天早上刷 RSS 的时候,我数了一下,AI HOT 过去 24 小时涌进来 99 条新闻。 Cursor 被 SpaceX 收了,Qwen 3.8 27B 开源且强得离谱,DeepSeek V4 Pro 和 Grok 4.6 同一天发布。这三件事搁在一起看,已经不是「谁家模型更强」的打法,而是 AI 正在从「拼参数」快速滑向「拼落地」。 我挑了 10 条值得细聊的新闻。 🔥 重点新闻1. Cursor 正式被 SpaceX 收购这个消息来得不算突然。 4 月份就传出收购传闻,现在尘埃落定。Cursor 并入 SpaceX 后,能得到全球最大规模的 GPU 集群,官方说法是模型会更强、运行成本更低,最终用户拿到的价格也会更低。 我关注的是另一个细节,本周三发布的 Grok 4.6 已经是双方合作产物。也就是说,SpaceX 不只是给钱,而是把算力和工程团队直接喂给了 Cursor 的模型迭代。 对开发者来说,变化可能在哪里? 坦率地讲,现在 AI 编程工具的竞争早就不是「谁补全代码更准」,而是「谁能用更低的成本提供更完整的模型栈」。Cursor 绑上 SpaceX 这条大船...
Anthropic 多智能体实验暴露的四个真相,LangGraph 落地前我重新审视了这件事
你愿不愿意让 45 个 AI 智能体同时访问同一个代码库? 8 月 13 日,Anthropic 的 Frontier Red Team 发布了一篇新研究,名字就叫「Patterns and problems in emerging multiagent systems」。他们真的把 45 个 agent 丢进 15 个开源项目,给每个 agent 一台虚拟机、一个共享论坛、一个统一目标,找漏洞。 结果是,协调合作的 agent 群体在 2700 万 token 的运行里找到了 266 个漏洞;而 45 个完全独立并行、各自被指定搜索范围的 agent,花了 650 万 token,只找到 21 个。 看起来多智能体协作完胜对不对?但同一份研究里还记录了另一些细节,让我看得后背发凉。 在另一个「用多 agent 一起开发文字冒险游戏」的实验里,18 个 agent 同时创建了一个叫「mvp-game-loop」的分支;在「写作工坊」里,多个 agent 在多次运行中把第一篇投稿都命名为「The Cartographer’s Last Commission」;在任务队列实验中,ag...
科技简报 | 2026年08月16日
今天早上刷 RSS,通义千问 Qwen3.8 的开源消息直接弹到我脸上。 说实话,这一周没太盯国产模型,结果一看吓一跳,阿里、智谱、DeepSeek、小红书、蚂蚁、MiniMax 全在出牌。不是小修小补,是把牌桌掀了重新发。 这篇简报把过去 24 小时里,中文科技圈最值得聊的 8 件事捋一遍。你可以跳着看,但我建议别漏掉第四条和第七条,那两个事儿有点意思。 阿里开源 Qwen3.8,27B 就把上代 Plus 超了Qwen3.8-27B 是这次最让我意外的型号。 它是个原生多模态稠密模型,只有 27B 参数,但阿里说它已经全面超越 Qwen3.7-Plus。上下文原生支持 262K,还能通过 YaRN 扩展到 1M tokens。 你想想看,27B 参数做到这个水平,这件事本身就挺离谱的。 如果 Qwen3.7-Plus 之前还是很多人的主力模型,那现在一个更小、更快、开源的版本骑到它头上,产品经理和创业者得重新算账了。 来源,@Alibaba_Qwen | 阅读原文 智谱 GLM-5.3,开源模型里编程第一智谱这周发了 GLM-5.3,基于和 GLM-5.2 相同的基座,但后训...
AI日报 | 2026年8月16日
今天早上刷 AI HOT,两条消息让我停下来多看了一眼。一条是 Cursor 被 SpaceX 正式收购,另一条是亚马逊上 AI 生成的书正在把人类作者的单书收入拉低。一个是顶层的算力整合,一个是创作者层面的收入挤压,AI 这一年正在同时向上和向下重塑整个行业。 🔥 重点新闻1. Cursor 被 SpaceX 收购,AI 编程工具进入垂直整合阶段Cursor 官方确认,SpaceX 已完成对 Cursor 的收购。这笔交易从 4 月开始推进,现在正式落地。合并后 Cursor 可以调用 SpaceX 的 GPU 集群,目标是训练更强、运行成本更低的模型,再以更低的价格把能力释放出来。 我自己觉得这件事很有意思的地方在于,Cursor 之前走的是「模型无关」的路线,靠产品体验切市场。现在被 SpaceX 收编,等于从工具层往基础设施层下沉了一大截。未来 Cursor 会不会和 Grok 系列越走越近,甚至变成 SpaceX AI 帝国的入口之一,值得继续观察。 来源,AI HOT 2. AI 生成书籍正在淹没亚马逊,人类作者收入被摊薄一项针对 14,419 本自出版电子书的...
Anthropic多智能体研究,当45个AI一起找漏洞时发生了什么
45 个 Claude 实例被同时放进 15 个开源项目里,目标只有一个,找漏洞。它们各自有一台虚拟机、一个共享论坛,还有一个审核 Agent 负责判定提交的漏洞是否真实有效。27M token 跑完,这群 Agent 挖出 266 个漏洞。而作为对照,传统的「各自为战」并行方案在 6.5M token 里只找到 21 个,且两者重叠的漏洞只有 12 个。 这是 Anthropic 8 月 13 日刚放出来的研究,标题叫「Patterns and problems in emerging multiagent systems」。我读完整篇之后的感受很复杂,一半是兴奋,另一半是后怕。兴奋的是,多智能体协作的潜力确实被验证了。后怕的是,那些我们以为只要模型够强就能自然解决的问题, coordination、信任、冲突消解,根本没想象中那么简单。 我自己平时用 LangGraph 搭多 Agent 工作流,读了这份研究后,脑子里反复回响一句话,协调能力不会从更强的单体智能里自动长出来。 协调这件事,分两种难度研究先做了一个我很喜欢的对照实验。 第一种设定把 45 个 Agent 丢进同...
科技简报 | 2026年8月15日
这周五的 AI 圈,热闹得像开学前夜的操场。 国内几家大厂几乎同时甩出新模型,海外的收购和大厂自研推理模型也来凑热闹。我看了一下 RSS 订阅,光是今天值得聊的就有十几条。挑其中最有意思的 8 条,跟你快速过一遍。 通义千问开源 Qwen3.8 系列,把多模态和长上下文一起卷了阿里通义千问开源了 Qwen3.8 系列。最亮眼的是 Qwen3.8-27B,原生多模态稠密模型,27B 参数就全面超过了 Qwen3.7-Plus。上下文原生 262K,可以通过 YaRN 扩展到 1M tokens。 我印象最深的是这个尺寸选择。27B 不算特别大,却把多模态和长上下文这两个高成本能力塞了进来。对开发者来说,结果就是能在单卡或低成本环境里跑一个相当能打的模型。 来源,@Alibaba_Qwen。 小红书开源 dots3-note Preview,280B 参数的「轻量」模型小红书技术团队开源了 dots3-note Preview。总参数 280B,激活参数 16B,支持 512K 上下文,还有文本、视觉、语音多模态理解,主打复杂推理和长程 Agent 任务。 说实话,280B 被叫「轻...
AI日报 | 2026年08月15日
SpaceX 把 Cursor 买了。 不是投资,是整家收购。Cursor 背后的团队从现在开始,能直接调用可能是地球上最大的 GPU 集群。你想想看,一家做 AI 代码编辑器的公司,突然有了火箭公司级别的算力后盾,这事本身就很科幻。 但更耐人寻味的是,这件事发生在同一天前后,DeepSeek V4 Pro 和 Grok 4.6 双双发布,Anthropic 给 Claude 加上文字水印以符合欧盟 AI 法案,OpenAI 和 Anthropic 同时降价应对中国模型的冲击。看起来,AI 行业的战场已经从「谁的模型更聪明」转向了「谁能把模型塞进合规、算力和商业的三角里」。 🔥 重点新闻1. SpaceX 正式收购 Cursor昨天下午消息传出来时,我第一反应是「是不是又是谣言」。毕竟 4 月份就传闻 SpaceX 在谈收购,Cursor 联合创始人也公开否认过。但 Cursor 官方博客发了公告,确认收购完成。 对 Cursor 用户来说,直接的好处是算力成本下降。SpaceX 手握全球最大 GPU 集群之一,Cursor 以后训练自有模型不需要再向第三方买卡。发布会上提...




