科技简报 | 2026年08月16日
今天早上刷 RSS,通义千问 Qwen3.8 的开源消息直接弹到我脸上。
说实话,这一周没太盯国产模型,结果一看吓一跳,阿里、智谱、DeepSeek、小红书、蚂蚁、MiniMax 全在出牌。不是小修小补,是把牌桌掀了重新发。
这篇简报把过去 24 小时里,中文科技圈最值得聊的 8 件事捋一遍。你可以跳着看,但我建议别漏掉第四条和第七条,那两个事儿有点意思。
阿里开源 Qwen3.8,27B 就把上代 Plus 超了
Qwen3.8-27B 是这次最让我意外的型号。
它是个原生多模态稠密模型,只有 27B 参数,但阿里说它已经全面超越 Qwen3.7-Plus。上下文原生支持 262K,还能通过 YaRN 扩展到 1M tokens。
你想想看,27B 参数做到这个水平,这件事本身就挺离谱的。
如果 Qwen3.7-Plus 之前还是很多人的主力模型,那现在一个更小、更快、开源的版本骑到它头上,产品经理和创业者得重新算账了。
来源,@Alibaba_Qwen | 阅读原文
智谱 GLM-5.3,开源模型里编程第一
智谱这周发了 GLM-5.3,基于和 GLM-5.2 相同的基座,但后训练 Scaling 拉满了。
编程能力比前代提升 50%,在 Terminal Bench 3.0 这类基准里拿了开源第一,接近 Claude Fable 5。
GLM-5.3 的完整定价我没在消息里看到,但「开源 + 编程强」这个定位,瞄准的其实就是想替代 Claude 的国内开发者。
来源,智谱官方 | 阅读原文
DeepSeek V4 Pro 正式上线,Agent 能力成了主菜
DeepSeek V4 Pro 这次不是简单刷榜。
它现在的 Agent 能力明显增强了,HLE(wo/w tools)到了 42.7/60.0,TerminalBench 也有提升。同时上下文窗口给到 1M,编码、工具调用、智能体工作流是重点。
我自己也还在摸索 Agent 工作流,但看到这个更新,我有点信了,DeepSeek 不是在追 OpenAI,它是在找自己最舒服的路。这条路就是「开源 + 长上下文 + Agent」。
来源,DeepSeek API 更新日志 / 硅基流动 | 阅读原文
DeepSeek 还开源了一个智能体框架 Harness
同一天,DeepSeek Harness v0.1 也出来了。
它基于 Cordis 元框架,核心理念是「一切皆插件」。模型、工具、技能、会话、沙箱、文件系统、循环、编排,全都能插拔。
这块需要注意一下,现在的智能体框架太多了,AutoGPT、LangGraph、Dify、FastAgent,各有各的抽象。Harness 能不能跑出来,取决于社区认不认可这套插件哲学。不过 DeepSeek 的名号,至少能让它先拿到入场券。
来源,@deepseek_ai | 阅读原文
小红书开源 dots3-note,280B 参数却走轻量路线
小红书技术这周开源了 dots3-note Preview,总参数 280B,激活参数只有 16B。
它支持 512K 上下文,能处理文本、视觉、语音,还针对复杂推理和长程 Agent 任务做了优化。
很多人可能纳闷,小红书一个内容平台为啥要做这么重的模型。我个人的感受是,他们不是在跟风做 ChatGPT,而是在给自己未来的内容理解、多模态搜索和创作工具铺路。这套东西如果能跑通,小红书的 AI 护城河会比想象中深。
来源,小红书技术(dots.llm) | 阅读原文
蚂蚁百灵跑通单机 Agentic RL 后训练闭环
这条消息藏在角落里,但含金量不低。
蚂蚁百灵和 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通了单机 Agentic RL 后训练闭环。最小验证任务是井字棋,训练 400 步后 rollout 胜率有明显提升。
坦率的讲,井字棋只是起点。但这件事有意思的地方在于,单卡或小集群就能做 Agentic RL 后训练,成本下来了,小公司才有机会跟大厂掰手腕。
来源,蚂蚁百灵 | 阅读原文
WorkBuddy 上线远程控制,Agent 工作流开始落地
WorkBuddy 这版更新挺实用,PC、App、小程序打通,手机能实时同步电脑端的任务、对话、工作空间和产物,还支持一台手机连多台电脑。
这不是概念视频,是真的可以远程控制电脑干活。你想想看,以后用手机让 Agent 在电脑上跑流程,人在地铁上也能收结果,这种体验一旦顺滑起来,很多人就回不去了。
来源,数字生命卡兹克 | 阅读原文
MiniMax Music 3.0,国产音乐模型也进化了
MiniMax 发布了 Music 3.0,能根据创意概念和可选歌词一次性完成整首歌的作曲、编曲、演奏与制作,最长支持五分钟。
音乐生成这块,Suno 和 Udio 名气更大,但 MiniMax 这次瞄准的是整首歌级别的完整制作。中文歌的旋律和歌词适配,一直是海外模型的短板,这反而可能是国内团队的机会。
来源,MiniMax Blog | 阅读原文
周末看这些消息,我的感觉是,国产 AI 的竞争已经从「谁参数大」转向「谁能真正塞进工作流」。
开源、Agent、长上下文、多模态,每个方向都有人押注。这对普通用户是好事,对创业者是压力,对投资人则是新一轮的赌局。
我也不确定谁最后能跑出来,但有一点挺清楚,再不看国产模型,真就有点跟不上了。
来源整理,AI HOT RSS / 通义千问 / 智谱 / DeepSeek / 小红书技术 / 蚂蚁百灵 / 数字生命卡兹克 / MiniMax






