AI日报 | 2026年7月1日
早上打开 RSS 时,Anthropic 一口气挤进来三条消息。 Sonnet 5、Claude Science,还有一条关于 Claude Code 被曝用 base64+XOR 加密列表识别中国用户的爆料。三件事摆在一起,倒不像是简单的产品更新,更像 Anthropic 正在把 Claude 从「聊天框」往外拽。今天我们就顺着这三条主线,把今天值得看的新闻过一遍。 🔥 重点新闻1. Claude Sonnet 5 发布,直接对标 Opus 4.8Anthropic 更新了 Sonnet 系列,推出了 Claude Sonnet 5。 按官方说法,它支持计划、浏览器和终端工具调用,能自主运行,性能接近 Opus 4.8,但价格更低。即日起至 2026 年 8 月 31 日,输入 token 定价打到 2 美元/百万 token 左右。 坦率的讲,这个价格很有杀伤力。Sonnet 一向是 Claude 系列里「性价比最高」的那条线,现在它把自主工具调用也加进来了,等于把原来只有 Opus 才有的高端能力往下放。普通开发者如果之前因为 Opus 太贵而只用 Sonn...
科技简报 | 2026年6月30日
你敢信,现在给机器人当老师,一天能赚 200 块? 这不是什么科幻设定,而是正在招聘的兼职岗位。具身智能数据采集员日薪 200 到 250 元,不要求学历和经验,面试先量身高体重,再问你晕不晕 VR。工作内容分两种,一种是穿戴设备控制双臂机器人完成分拣积木、叠纸杯这类动作,另一种更原始,徒手重复叠衣服,让设备记录动作数据。 坦率的讲,这个画面挺矛盾的。一边是 AI 被吹成要替代人类的终极生产力,另一边是它还需要人类一帧一帧教它怎么叠衣服。机器人离真正「懂事」,可能比我们想象的要远得多。 回到今天的科技简报,我把过去 24 小时值得聊的中文科技圈动态挑了 8 条出来。 国务院发文,AI 教育要进全学段来源,IT之家 国务院日前印发《教育发展「十五五」规划》,明确要求推进人工智能全学段教育,提升学生 AI 素养,以及提出问题和解决问题的能力。 这个信号其实挺重的。不是说以前不提 AI 教育,而是把它写进国家级五年规划,教材、师资、考核体系可能都会跟着动。有意思的是,规划同时强调了科技教育与人文教育协同,加强批判性思维。所以呢,官方也意识到,光教孩子用 AI 不够,还得教他们不被 A...
AI日报 | 2026年06月30日
你有没有发现,这个夏天的 AI 开始变得不一样了? 不是某个模型又刷榜了,而是它开始往你真正的工作场景里钻。手机、终端、企业私有云、甚至战场指挥系统,AI 的触角一下子伸得到处都是。2026 年 6 月 30 日这一天的消息,把这种「渗透感」表现得特别清楚。 🔥 重点新闻1. Anthropic 推出 Claude apps gateway,让企业把 Claude Code 跑在自己的云上坦率的讲,这条新闻可能改变接下来一年企业采用 AI coding agent 的方式。 Anthropic 今天发布了一个叫 Claude apps gateway 的东西。简单说,它是一个自托管的控制平面,让企业可以在 Amazon Bedrock 和 Google Cloud 上运行 Claude Code。部署形态是一个无状态 Linux 容器,后端不需要你重新造轮子。 这事的妙处不在技术复杂度,而在「姿态」。之前企业用 Claude Code,要么走 Anthropic 自己的 API,要么通过第三方平台。现在 Anthropic 直接把控制平面交给你,让你在自己已经付费的云环境里...
科技简报 | 2026年06月29日
3B参数的小模型,凭什么在数学竞赛里吊打200倍体量的对手? 说实话,我刚看到新浪开源的VibeThinker-3B时,第一反应是「又一个小模型,能有多厉害」。结果翻完数据我就愣住了。AIME26这种级别的数学基准,它跟DeepSeek V3.2(那可是671B参数的巨兽)打成了平手。LiveCodeBench上更是直接碾压所有20B以下的模型,LeetCode竞赛解决了123/128题,连GPT-4.5都被它甩在后面。 3B对671B,差了200多倍的体量,凭啥? 我仔细看了下,它的核心思路挺有意思。推理过程可以压缩,但事实知识不能。它做的事,就是把「思考路径」极致优化,该想的地方想透,不该浪费算力的地方一分钱都不花。这让我想到,可能大模型的军备竞赛正在进入一个新的阶段,不是谁参数多谁就赢,而是谁更懂「怎么聪明地算」。 顺着这个思路再聊聊效率。DeepSeek最近开源的DSpark框架,做的事情其实跟VibeThinker有点异曲同工。它不是在DeepSeek-V4旁边再搭一个新模型,而是直接在现有权重上附加一个草稿模块,用半自回归的方式并行生成。生产环境里,V4-6...
AI日报 | 2026年06月29日
我早上扫了100条AI新闻,有三件事让我停下了鼠标。马斯克把xAI「注销」了,Grok 4.5已经在SpaceX和Tesla内部测试,还有个3B参数的小模型在数学竞赛上干翻了比它大300倍的对手。今天的AI圈,整合、提速、浓缩,这三个词来回穿插。 🔥 重点新闻1. xAI 解散并入 SpaceX,Grok 4.5 开启内部私测SpaceX 刚刚注册了 SpaceXAI 商标。马斯克随后确认,xAI 将不再作为独立公司存在,而是彻底并入 SpaceX,成为后者旗下的 AI 产品部门。几乎在同一时间,Grok 4.5 的私测消息也放了出来。这款模型基于 1.5T V9 基础模型,训练数据里加入了 Cursor 的代码数据,目前已经在 SpaceX 和 Tesla 的内部环境跑起来了。初步评估显示,它的性能接近甚至可能超越 Claude Opus。 坦率的讲,这个动作的冲击力不在模型本身,而在组织形态。Grok 从一家独立的 AI 公司变成 SpaceX 的 AI 部门,意味着它的应用场景会从聊天机器人扩展到航天发射、自动驾驶、制造流程。xAI 的「消失」或许标志着一个趋势——纯...
科技简报 | 2026年06月28日
你有没有发现,最近的 AI 工具越来越像一个具体的「产品」而不是一个遥远的「技术」了? 阿里今天正式上线了千问输入法 macOS 版,DeepSeek 开源了新的加速框架,甚至连自动驾驶的法规都要落地了。这些变化看起来零散,但串在一起看,它们都在指向同一个方向,AI 不再只是实验室里的概念,而是开始扎扎实实地嵌入你每天都在用的东西里。 阿里千问输入法 macOS 版上线,打字也能 AI 了 阿里千问团队今天正式推出了 macOS 版的千问输入法。支持最快 300 字/分的 AI 语音输入,还能自动把口语化的内容润色成工整的文字。更实用的是,它支持 9 种方言,而且官方强调「纯净无广告」。iOS、Android 和 Windows 版本也将在近期发布。 说真的,输入法这个场景选得挺准的。它不像聊天机器人那样需要用户主动打开,而是直接嵌在你最自然的交互里,打字。你每敲一个键,AI 都在旁边默默工作。这种「无感嵌入」的打法,可能比那些需要用户专门去用的 AI 应用更有渗透力。 来源,IT之家 DeepSeek 开源 DSpark,V4 生成速度直接提升 60% 到 85% D...
AI日报 | 2026年6月28日
你有没有试过,凌晨两点测试一个新模型,然后看着输出速度直接翻倍,整个人都清醒了? DeepSeek 的 DSpark 在昨晚更新了,推理速度提升 85%。我在本地跑了一遍,32B 模型的输出直接飙到了每秒 180 个 token。说真的,这感觉太爽了。 但比速度更刺激的,是这一周 AI 圈发生的事情密度。OpenAI 扔出了 GPT-5.6,Anthropic 的 Mythos 被曝出能自主清空银行账户,马斯克把 xAI 并进了 SpaceX。信息密度高到让人有点喘不过气。 咱们一件件聊。 🔥 重点新闻1. DeepSeek DSpark 发布,推理速度提升 85%这件事我必须放第一个。DeepSeek 发布了 DSpark,一个基于推测解码的推理加速方案。梁文锋亲自署名了论文,生成速度大涨 85%。 坦率的讲,之前很多推测解码方案都是实验室里的漂亮数字,一到真实场景就拉胯。DSpark 不同的地方在于,它直接集成到了 DeepSeek V4 的推理链路里,不是额外插件,而是原生支持。我昨晚跑了几个长文本总结任务,32B 模型的输出确实快得离谱,而且质量没有明显下滑。 这背...
科技简报 | 2026年6月27日
今天最让我意外的新闻,不是某个大模型又刷了什么榜单,而是龙芯中科悄悄放出了 16 核服务器芯片 3C3000。 你可能觉得这没什么,但仔细一看,这颗芯片用的是成熟自主工艺,通用计算性能对标自家上一代的 3C5000。其实就是,龙芯在用更便宜的制程做出差不多的性能,这背后是架构层面的优化,不是靠堆工艺。 好了,进入今天的正题。 一、DeepSeek 启动大规模招聘,所有部门规模至少翻倍DeepSeek 官宣启动大规模招聘,计划将所有部门的规模扩大至少一倍。 这个消息一出,圈内人都在讨论一个问题,DeepSeek 到底在憋什么大招? 从公开信息看,DeepSeek 的推理模型已经打出了名气,V3 和 R1 系列在开源社区的口碑相当不错。现在大规模扩招,说明他们不只是想做模型,而是想把整个生态铺开。 坦率的讲,国内 AI 公司里,真正有技术信仰的团队不多,DeepSeek 算一个。这次扩招,值得关注他们接下来的动作。 二、0.7nm 制程芯片问世,摩尔定律又活了这可能是今天最硬核的一条新闻。0.7nm 制程芯片正式问世,意味着摩尔定律在被认为”已死”之后,又一次被续命了。 你想想看,...
AI日报 | 2026年6月27日
今天 AI 圈发生了一件大事,大到让我觉得有必要重新审视整个行业的走向。 OpenAI 发布了 GPT-5.6 系列,Anthropic 的 Mythos 5 被美国政府放行,两条消息几乎同时砸出来。但真正让我愣住的,不是模型有多强,而是「谁被允许用」这个问题。 🔥 重点新闻1. OpenAI 发布 GPT-5.6 系列,但你用不了GPT-5.6 系列今天正式亮相,三款模型各司其职。 Sol(旗舰版),Terminal-Bench 2.1 标准模式 88.8%,超过 Claude Mythos 5 的 88.0%,Ultra 模式更是冲到 91.9%。定价 $5/$30(输入/输出,每百万 token) Terra(均衡版),性能接近 GPT-5.5 但成本减半,$2.5/$15 Luna(速度版),$1/$6,主打高吞吐低延迟 听着很美对吧?但 OpenAI 在公告里写了一句让人不太舒服的话,「应美国政府要求」,目前仅向一小部分「可信合作伙伴」开放,普通开发者几周后才有机会。 来源,OpenAI 官方博客 HN 上 805 po...
科技简报 | 2026年6月26日
指甲盖大小的芯片上塞进 1000 亿个晶体管。 IBM 昨天扔出的这颗炸弹,把整个半导体行业的预期又往前推了一截。0.7 纳米节点,全新三维纳米堆叠架构,密度是 2021 年 2nm 技术的将近 4 倍。说实话,摩尔定律被宣判死刑已经好几年了,但 IBM 似乎没收到通知。 今天这份简报,我们从这颗芯片聊起,再看看 AI 经济的真实体量、开发者工具的最新战场,以及几家大厂各自在忙什么。 1. IBM 拿出亚纳米级芯片,0.7nm 节点首次亮相IBM 宣布推出全球首款亚纳米级芯片技术,采用 0.7nm(7 埃米)节点和全新的三维纳米堆叠(nanostack)架构。指甲盖大小的芯片上集成了将近 1000 亿个晶体管,密度大约是 IBM 2021 年展示的 2nm 技术的 4 倍。 你想想看,从 2nm 到 0.7nm,中间跨了好几个技术代际。业界一直在讨论「物理极限」这件事,但 IBM 这次用 nanostack 架构绕了一条路——不是继续把晶体管做小,而是往上堆。 坦率的讲,这还只是实验室阶段,离量产还有距离。但方向已经很清楚了,三维堆叠大概率是后摩尔时代的主赛道之一。 来源,Ha...




