一边是 770B 参数、1M 上下文的开源模型,一边是开发者拿着自有 API Key 给 IDE 留后路。今天的科技新闻挤在同一张桌子上,规模很大,动作却很具体。

模型还在冲高,算力仍然紧张。但对真正要把 AI 接进产品的人,新闻里最值得盯的不是发布会上的最大数字,而是三个更近的问题,模型能否带走,能力能否接入工作流,权限出了问题能否收回。

这一期从 AI HOT RSS 里挑了 8 条。国内模型发布是主线,也放进了几条会直接影响开发者工具和团队治理的消息。以下均据公开摘要整理,具体能力、榜单和商业安排仍应以原始公告为准。

智谱开源 GLM-5.3,先把 Agent 编程放到牌桌中央

智谱公布 GLM-5.3 模型权重,定位是智能体编程、防御性网络安全和长程任务,也支持本地运行与定制。AI HOT RSS 汇集的 IT之家报道提到,它在 AA 综合智能指数中得到 60 分,官方则强调模型权重已经开放。

开源模型最容易陷进一场参数和跑分竞赛。但团队真正会遇到的是另一回事,工具调用失败后它会不会乱撞,长任务跑了半小时能不能把状态接回来,权限边界被触到时会不会停手。这些不在一张总榜里,却决定它能不能进生产流程。

权重开放不是终点,它只是让评估终于能从演示台走进自己的仓库。

来源,IT之家智谱

腾讯混元 Hy4 preview,把大参数和长上下文一起抛出来

腾讯混元发布 Hy4 preview,总参数 770B、激活参数 49B、上下文长度 1M,并宣布开源及在腾讯云 TokenHub、OpenRouter 上线。

770B 很抓眼球,不过做应用时,49B 和 1M 更该一起看。前者关系到每次推理实际要消耗多少资源,后者关系到项目资料、历史工单和多轮任务能放进多大的窗口。你想想看,能把整本手册塞进去,和能从里面找对那一页,是两件事。

上下文越长,检索、压缩、权限隔离和评估越不能省。模型的胃口变大了,工程上的消化能力也得跟上。

来源,腾讯混元

MiniMax 的 24 小时 AI 直播,开始碰内容生产的另一头

MiniMax 将 H3 Max 的 768P、480P 接入开放平台和 MiniMax Design。公开案例里,海外开发者已经用它搭起 Twitch 直播和全天候的 AI 电视台。

这类项目一眼看去很像又一个生成视频演示。再往里看,事情有点不一样。短视频生成解决的是单条内容,持续直播碰到的却是选题、角色一致性、素材衔接、审核和成本控制。画面能动只是起点,系统能不能连续运转才是难点。

很多内容团队可能会先把它当作玩具,这很正常。可当生成模型被放进持续供给的内容链路,创作工具和自动化运营之间的边界会越来越薄。

来源,MiniMax

日均 500 万亿 Token,竞争开始落到工程账上

IT之家报道,截至 2026 年 6 月,我国日均 Token 调用量已突破 500 万亿。单看这个数很难有直觉,放回产品现场就比较清楚了,模型能力之外,计费、缓存、模型路由、数据合规和故障降级都会进入日常工作。

这话听着有点刺耳但,Demo 跑得漂亮和规模化可用,中间隔着一整套工程账。不是每个团队都要自建模型网关,不过至少该知道自己的请求去了哪里,贵在哪里,失败后会落到哪里。

调用量一旦上去,稳定性就不再是基础设施团队的独角戏。

来源,IT之家

国产模型的价格战,也在挤压开发者的选择成本

智谱 CEO 唐杰称,GLM-5.3 Flash AA 在 OpenRouter 的周 Token 份额接近 20%,并以较低价格取得 AA 指数 57。这个说法来自企业高管公开发言,适合当作市场信号,而不是独立验证后的结论。

便宜当然重要,尤其是在高频 Agent 任务里。但单价低不等于总成本低。重试次数、上下文长度、工具调用成功率和运维复杂度,都会把账单改写。很多朋友在试模型时只测一次问答,结果上线后才发现最贵的是失败。

模型选择正在从单选题变成组合题。

来源,唐杰

Gemini 3.5 Transcribe,让语音链路少拼几块积木

Google 发布 Gemini 3.5 Transcribe,支持实时与预录音频转写,并提供说话人分离、词级时间戳、85 种以上语言识别和代码切换。对会议纪要、客服质检、口述工单和语音 Agent 来说,重点不只在于把声音转成文字,还在于知道谁在什么时候说了哪一句。

指标在中文噪声、多人抢话和专业词汇里能剩下多少,我自己也还在等更多实测。可 API 一次给出实时流、时间轴和说话人信息,确实能减少应用层自己拼装的环节。

语音输入正在从附加功能,慢慢变成 Agent 的标准零件。

来源,Google AI DEVHacker News 热门中文翻译

Cursor 与 OpenAI 的合作变化,暴露了模型入口的脆弱

OpenAI 表示拟在 2026 年 11 月 12 日终止向 Cursor 提供模型访问。Cursor 回应称,OpenAI 模型约承载其 5% 的用户流量,用户仍可通过自有 OpenAI API Key 和 IDE 扩展使用 GPT。

双方具体安排外界看不全,没必要替任何一方下结论。可开发者该吸取的教训很直接,IDE 里的默认模型入口不是稳定地基。供应商政策、合规要求和收购关系,都可能在某一天改变你的工作台。

对核心开发流程,至少准备自带 Key、多模型路由和关键任务的降级路径。平时多一点配置,变化发生时少一点被动。

来源,OpenAICursor

Claude 把个人 Key 和服务账号拆开,权限终于更像权限了

Claude Console 新增个人密钥与服务账号密钥。个人密钥关联个人账户并继承权限,账户离开组织后会自动失效,也可以限定到特定工作区。

这个更新不够炫,却很实用。团队把模型接进 CI、内部工具或 Agent 后,最怕一把共享 Key 用到底。出了问题查不到归属,人员变化收不回权限,成本也没法准确归集。

权限不是后台里一页不起眼的配置,它就是 Agent 产品的一部分。

来源,Claude Platform

今天真正该留住的,是一张很小的清单

770B、1M、500 万亿,这些数字会继续往上走。你打开自己的项目,眼前更紧迫的或许只有四件事,模型能不能替换,权限能不能回收,调用能不能观测,失败能不能降级。

大模型的故事常常从很大的数字开始,最后还是落在一把 Key 和一次请求上。