早上刷 AI HOT 的时候,一条消息把我从椅子上拽了起来,阿里居然把 Qwen-Max 级别的模型开源了。

不是 7B 的小玩具,是 2.4T 总参数、95B 激活参数的 MoE 巨兽,原生上下文 256K。这对国内大模型圈来说,跟往湖里扔了块大石头差不多。

今天就顺着这条线,把值得关注的 8 条科技动态一起聊聊。

1. 阿里开源 Qwen3.8-2.4T-A95B,国产大模型进入超大规模开源时代

阿里 Qwen 团队正式开放了 Qwen3.8-2.4T-A95B 的权重。坦率的讲,这个参数规模放到全球开源阵营里也是第一梯队。2.4T 总参数、95B 激活、原生 256K 上下文,还能扩展到 1M。

更关键的是,这是 Qwen-Max 级别的模型首次开源。之前大家想摸到这种水平的模型,基本只能靠 API。

现在权重一放出来,中小企业和研究机构就有了更多可折腾的空间。微调、蒸馏、本地部署的探索会很快跟上来。来源,IT之家。

2. DeepSeek V4 Pro 和 Grok 4.6 同一天发布,大模型发布会开始撞车了

就在阿里开源的同一天,DeepSeek V4 Pro 正式版和 Grok 4.6 在前后两小时内接连发布。两家公司发布时间凑得这么近,很难说完全是巧合。

这两个都是 1.5T 到 1.6T 参数规模的模型,体验上已经逼近 Claude Fable 5。厂商之间的竞争节奏明显在加快,以前按月算,现在按小时算。

对普通用户来说其实是好事,选择变多了,价格战也会更狠。来源,公众号「数字生命卡兹克」。

3. 微软发布自研推理模型 MAI-Thinking-1,不再只靠 OpenAI

微软这次不是发布 Copilot 的新功能,而是直接上了自己从零开始训练的推理模型 MAI-Thinking-1,现在已经在 Microsoft Foundry 上线。

Mustafa Suleyman 亲自发推站台。这个动作说明微软在大模型上的策略越来越独立,不再把所有鸡蛋都放在 OpenAI 这一个篮子里。

自研模型加已有的企业渠道,微软在 B 端智能体赛道上的底气又厚了一层。来源,Mustafa Suleyman 推文。

4. LTX-2.5 把视频生成速度拉进秒级,10 秒 720P 只要 6.8 秒

LTX 发布的 LTX-2.5 有点离谱。在两块英伟达 GB200 上,生成 10 秒 720P 视频只需要 6.8 秒,而且原生集成了 ComfyUI。

Fast 版本更夸张,每秒 0.09 美元就能生成带音频的 720p 视频。

视频生成这个赛道,上半年还在拼画质,下半年已经开始拼速度和成本了。短片创作者和广告团队会最先受益。来源,IT之家。

5. ChatGPT 和 Gemini 双双突破 10 亿月活,AI 聊天成为真·大众产品

OpenAI 和 Google 几乎同时宣布,ChatGPT 和 Gemini 的月活用户都超过了 10 亿。

10 亿是什么概念?这已经是社交媒体级别的体量。Gemini 还成了 Google 史上增长最快的产品,也是第 14 个达到 10 亿用户里程碑的产品。

AI 聊天工具从尝鲜阶段,彻底进入了日常工具阶段。来源,The Verge。

6. Mojo 1.0 正式发布,AI 编程语言终于有了稳定版

Mojo 语言正式发布 1.0 版本。这个被很多人寄予厚望的 AI 编程语言,从 2023 年首次亮相到现在,走了不算短的路。

开源标准库以来,已经有近 200 名贡献者提交了超过 1100 个 PR,改动超过 20 万行代码。1.0 的意义在于它给了生态一个稳定的基线,第三方库和工具可以开始认真往上建了。

对于做 AI infra 的开发者来说,这算是个值得放进关注列表的消息。来源,Hacker News 热门。

7. 英伟达被曝正在研发万亿参数开源模型 Nemotron 4

消息称英伟达正在开发新一代开源模型系列 Nemotron 4,规模最大的模型预计至少 1 万亿参数,目标直指全球最先进的开源模型。

目前最终训练还没完成,发布时间也没定,但员工透露最快可能今年秋末准备就绪。英伟达的动作很有意思,它不只是卖卡,还想从模型层影响开源生态的走向。

如果万亿参数开源模型真的落地,训练和推理的硬件需求又会再上一个台阶。来源,IT之家。

8. AutoGPT 用 AGENTS.md 和技能门控管住 AI 提交的代码

AutoGPT 团队分享了一个很实在的踩坑经验。他们发现,AI 智能体不会主动读文档,所以把指令直接塞进 AGENTS.md 和技能文件里,放在代码目录旁边。

另外,他们给 AI 提交的 PR 加了硬门槛,强制 PR 模板、测试计划、CI 覆盖率门槛、CLA 签名,一个都不能少。结果有效提升了 AI PR 的可合并率。

这个案例最有价值的地方不是技术多新,而是它给出了一个真实可行的治理模板。来源,GitHub Blog。

小结

今天这一批新闻里,国内厂商的存在感特别强。阿里开源超大模型、DeepSeek 紧追国际一线,说明中国团队在大模型赛道上已经不再是跟随者。

同时,应用层也在加速。10 亿月活、秒级视频生成、AI 提交的 PR 开始被治理,这些信号加在一起,给人的感觉是,AI 从实验室里的热闹,正在变成生产线上的日常。

明天再看看,这潭水还会被哪些新石头搅动起来。