AI日报 | 2026年7月3日
今天早上刷 AI HOT 的时候,有两条新闻直接撞到我脸上。 一条是 Claude Fable 5 只花了 4.44 美元,就搭出一台复杂的鲁布·戈德堡机械。另一条是微软成立「Frontier Company」,砸了 25 亿美元,准备把 6000 名 AI 工程师派驻到企业客户现场。 一个像单兵能力的极限突破,一个像集团军的组织化落地。把它们放在一起看,你会发现 Agent 正在两个方向上同时发生质变,做复杂事的成本越来越低,大厂也在拼命把 Agent 塞进真实的工作流。 🔥 重点新闻1. 微软成立「Frontier Company」,25 亿美元派驻 6000 名 AI 工程师Microsoft 新设了一个叫「Frontier Company」的部门,拨款 25 亿美元,计划派驻 6000 名行业与工程专家到企业客户现场。目标不是单纯卖软件,而是跟客户一起设计、部署、迭代 AI 系统。 这个做法跟以往很不一样。以前微软卖的是 Azure、Office、Copilot 这些标准化产品,客户买回去自己用。现在是把人送进去,把咨询服务内嵌到交付里。说明大厂已经意识到,企业上 ...
科技简报 | 2026年07月02日
今天早上刷 RSS,美团开源万亿参数大模型 LongCat-2.0 的消息直接把我从床上拽起来了。 1.6T 总参数、原生 1M 上下文、五万卡国产算力集群训练,这几个关键词叠在一起,不再是「国产大模型追一追」的感觉,而是真正摸到国际第一梯队边上了。坦率讲,这步棋下得很大。万亿参数模型的训练成本摆在那里,美团选择开源,说明他们对后续生态有信心。 顺着上面的再聊聊,今天挑了 9 条科技动态,国内国外的都有,给你快速过一遍。 1. 美团 LongCat-2.0 正式发布并开源来源,公众号 龙猫LongCat(美团) 6 月 30 日,美团发布新一代万亿参数大模型 LongCat-2.0,总参数 1.6T,平均激活约 48B,原生支持 1M 超长上下文。最值得关注的是,它是在五万卡国产算力集群上完成全流程训练和推理的。 模型采用 LSA 稀疏注意力、零计算专家、ScMoE 及 MOPD 多专家融合等技术。美团这次不是「发布」,而是「开源」。这步棋,赌的是国产算力生态和开发者社区。 2. 智谱推出 GLM-5.2 官方开发环境 ZCode来源,Zai_org 智谱上线 ZCode,这是 ...
AI日报 | 2026年7月2日
你有没有注意到,2026 年的 AI 竞争早就不是单纯比模型聪明了。 今天一早刷到几条新闻,我感觉整个行业正在往「基础设施变现」和「地缘技术隔离」两个方向猛拐。一边是 Meta 要把自家过剩的 AI 算力打包成云服务卖给对手,一边是 Anthropic 被曝出在 Claude Code 里用隐写术识别中国用户。这种反差本身就挺值得琢磨的。 🔥 重点新闻1. Meta 也要卖云了,目标直指 AWS 和 AzureMeta 正在筹备一个叫 Meta Compute 的新业务部门,计划把自研的 AI 基础设施和模型访问能力对外开放。这件事最刺激的地方在于,Meta 未来几年要在 AI 基建上砸 1829 亿美元,现在却准备把其中一部分算力卖给其他公司。 坦率的讲,这个逻辑跟 SpaceX 的 Starlink 有点像,先为了自身需求建基础设施,再把冗余产能变成生意。但 Meta 面对的挑战也实实在在,企业客户凭什么信任一个模型竞争对手提供的云?AWS、Google Cloud、Azure 已经做了十几年的企业信任积累,Meta Compute 想分一杯羹,恐怕不只是算力便宜就能搞...
科技简报 | 2026年7月1日
今天是2026年下半年第一天,科技圈已经没打算让人喘口气。 早上先是看到美团放出了 LongCat-2.0,1.6T 参数的 MoE 模型,每百万 tokens 0.75 美元。没过几小时,另一则消息把中文 Twitter 和朋友圈点着了,Anthropic 被曝在 Claude Code 里加了隐写术,靠读取本地时区和环境变量来识别中国用户。两件事撞在一起,一边是国产模型在拼性价比,一边是国外厂商在小心翼翼地画边界。 我挑了今天最值得聊的 8 条消息,按顺序过一遍。 1. 美团 LongCat-2.0 发布,性价比牌打得很凶来源,SiliconFlowAI / 美团 LongCat-2.0 是美团和硅基流动一起推出的旗舰模型。1.6T 总参数、约 48B 活跃参数的 MoE 架构,原生支持 1M 上下文。定价方面,Input Cache 0.015 美元/1M tokens,Input 0.75 美元/1M tokens,Output 2.0 美元/1M tokens。 这个价格一出来,几个做 RAG 和 Agent 的朋友已经开始算成本...
AI日报 | 2026年7月1日
早上打开 RSS 时,Anthropic 一口气挤进来三条消息。 Sonnet 5、Claude Science,还有一条关于 Claude Code 被曝用 base64+XOR 加密列表识别中国用户的爆料。三件事摆在一起,倒不像是简单的产品更新,更像 Anthropic 正在把 Claude 从「聊天框」往外拽。今天我们就顺着这三条主线,把今天值得看的新闻过一遍。 🔥 重点新闻1. Claude Sonnet 5 发布,直接对标 Opus 4.8Anthropic 更新了 Sonnet 系列,推出了 Claude Sonnet 5。 按官方说法,它支持计划、浏览器和终端工具调用,能自主运行,性能接近 Opus 4.8,但价格更低。即日起至 2026 年 8 月 31 日,输入 token 定价打到 2 美元/百万 token 左右。 坦率的讲,这个价格很有杀伤力。Sonnet 一向是 Claude 系列里「性价比最高」的那条线,现在它把自主工具调用也加进来了,等于把原来只有 Opus 才有的高端能力往下放。普通开发者如果之前因为 Opus 太贵而只用 Sonn...
科技简报 | 2026年6月30日
你敢信,现在给机器人当老师,一天能赚 200 块? 这不是什么科幻设定,而是正在招聘的兼职岗位。具身智能数据采集员日薪 200 到 250 元,不要求学历和经验,面试先量身高体重,再问你晕不晕 VR。工作内容分两种,一种是穿戴设备控制双臂机器人完成分拣积木、叠纸杯这类动作,另一种更原始,徒手重复叠衣服,让设备记录动作数据。 坦率的讲,这个画面挺矛盾的。一边是 AI 被吹成要替代人类的终极生产力,另一边是它还需要人类一帧一帧教它怎么叠衣服。机器人离真正「懂事」,可能比我们想象的要远得多。 回到今天的科技简报,我把过去 24 小时值得聊的中文科技圈动态挑了 8 条出来。 国务院发文,AI 教育要进全学段来源,IT之家 国务院日前印发《教育发展「十五五」规划》,明确要求推进人工智能全学段教育,提升学生 AI 素养,以及提出问题和解决问题的能力。 这个信号其实挺重的。不是说以前不提 AI 教育,而是把它写进国家级五年规划,教材、师资、考核体系可能都会跟着动。有意思的是,规划同时强调了科技教育与人文教育协同,加强批判性思维。所以呢,官方也意识到,光教孩子用 AI 不够,还得教他们不被 A...
AI日报 | 2026年06月30日
你有没有发现,这个夏天的 AI 开始变得不一样了? 不是某个模型又刷榜了,而是它开始往你真正的工作场景里钻。手机、终端、企业私有云、甚至战场指挥系统,AI 的触角一下子伸得到处都是。2026 年 6 月 30 日这一天的消息,把这种「渗透感」表现得特别清楚。 🔥 重点新闻1. Anthropic 推出 Claude apps gateway,让企业把 Claude Code 跑在自己的云上坦率的讲,这条新闻可能改变接下来一年企业采用 AI coding agent 的方式。 Anthropic 今天发布了一个叫 Claude apps gateway 的东西。简单说,它是一个自托管的控制平面,让企业可以在 Amazon Bedrock 和 Google Cloud 上运行 Claude Code。部署形态是一个无状态 Linux 容器,后端不需要你重新造轮子。 这事的妙处不在技术复杂度,而在「姿态」。之前企业用 Claude Code,要么走 Anthropic 自己的 API,要么通过第三方平台。现在 Anthropic 直接把控制平面交给你,让你在自己已经付费的云环境里...
科技简报 | 2026年06月29日
3B参数的小模型,凭什么在数学竞赛里吊打200倍体量的对手? 说实话,我刚看到新浪开源的VibeThinker-3B时,第一反应是「又一个小模型,能有多厉害」。结果翻完数据我就愣住了。AIME26这种级别的数学基准,它跟DeepSeek V3.2(那可是671B参数的巨兽)打成了平手。LiveCodeBench上更是直接碾压所有20B以下的模型,LeetCode竞赛解决了123/128题,连GPT-4.5都被它甩在后面。 3B对671B,差了200多倍的体量,凭啥? 我仔细看了下,它的核心思路挺有意思。推理过程可以压缩,但事实知识不能。它做的事,就是把「思考路径」极致优化,该想的地方想透,不该浪费算力的地方一分钱都不花。这让我想到,可能大模型的军备竞赛正在进入一个新的阶段,不是谁参数多谁就赢,而是谁更懂「怎么聪明地算」。 顺着这个思路再聊聊效率。DeepSeek最近开源的DSpark框架,做的事情其实跟VibeThinker有点异曲同工。它不是在DeepSeek-V4旁边再搭一个新模型,而是直接在现有权重上附加一个草稿模块,用半自回归的方式并行生成。生产环境里,V4-6...
AI日报 | 2026年06月29日
我早上扫了100条AI新闻,有三件事让我停下了鼠标。马斯克把xAI「注销」了,Grok 4.5已经在SpaceX和Tesla内部测试,还有个3B参数的小模型在数学竞赛上干翻了比它大300倍的对手。今天的AI圈,整合、提速、浓缩,这三个词来回穿插。 🔥 重点新闻1. xAI 解散并入 SpaceX,Grok 4.5 开启内部私测SpaceX 刚刚注册了 SpaceXAI 商标。马斯克随后确认,xAI 将不再作为独立公司存在,而是彻底并入 SpaceX,成为后者旗下的 AI 产品部门。几乎在同一时间,Grok 4.5 的私测消息也放了出来。这款模型基于 1.5T V9 基础模型,训练数据里加入了 Cursor 的代码数据,目前已经在 SpaceX 和 Tesla 的内部环境跑起来了。初步评估显示,它的性能接近甚至可能超越 Claude Opus。 坦率的讲,这个动作的冲击力不在模型本身,而在组织形态。Grok 从一家独立的 AI 公司变成 SpaceX 的 AI 部门,意味着它的应用场景会从聊天机器人扩展到航天发射、自动驾驶、制造流程。xAI 的「消失」或许标志着一个趋势——纯...
科技简报 | 2026年06月28日
你有没有发现,最近的 AI 工具越来越像一个具体的「产品」而不是一个遥远的「技术」了? 阿里今天正式上线了千问输入法 macOS 版,DeepSeek 开源了新的加速框架,甚至连自动驾驶的法规都要落地了。这些变化看起来零散,但串在一起看,它们都在指向同一个方向,AI 不再只是实验室里的概念,而是开始扎扎实实地嵌入你每天都在用的东西里。 阿里千问输入法 macOS 版上线,打字也能 AI 了 阿里千问团队今天正式推出了 macOS 版的千问输入法。支持最快 300 字/分的 AI 语音输入,还能自动把口语化的内容润色成工整的文字。更实用的是,它支持 9 种方言,而且官方强调「纯净无广告」。iOS、Android 和 Windows 版本也将在近期发布。 说真的,输入法这个场景选得挺准的。它不像聊天机器人那样需要用户主动打开,而是直接嵌在你最自然的交互里,打字。你每敲一个键,AI 都在旁边默默工作。这种「无感嵌入」的打法,可能比那些需要用户专门去用的 AI 应用更有渗透力。 来源,IT之家 DeepSeek 开源 DSpark,V4 生成速度直接提升 60% 到 85% D...




