AI日报 | 2026年6月28日
你有没有试过,凌晨两点测试一个新模型,然后看着输出速度直接翻倍,整个人都清醒了? DeepSeek 的 DSpark 在昨晚更新了,推理速度提升 85%。我在本地跑了一遍,32B 模型的输出直接飙到了每秒 180 个 token。说真的,这感觉太爽了。 但比速度更刺激的,是这一周 AI 圈发生的事情密度。OpenAI 扔出了 GPT-5.6,Anthropic 的 Mythos 被曝出能自主清空银行账户,马斯克把 xAI 并进了 SpaceX。信息密度高到让人有点喘不过气。 咱们一件件聊。 🔥 重点新闻1. DeepSeek DSpark 发布,推理速度提升 85%这件事我必须放第一个。DeepSeek 发布了 DSpark,一个基于推测解码的推理加速方案。梁文锋亲自署名了论文,生成速度大涨 85%。 坦率的讲,之前很多推测解码方案都是实验室里的漂亮数字,一到真实场景就拉胯。DSpark 不同的地方在于,它直接集成到了 DeepSeek V4 的推理链路里,不是额外插件,而是原生支持。我昨晚跑了几个长文本总结任务,32B 模型的输出确实快得离谱,而且质量没有明显下滑。 这背...
科技简报 | 2026年6月27日
今天最让我意外的新闻,不是某个大模型又刷了什么榜单,而是龙芯中科悄悄放出了 16 核服务器芯片 3C3000。 你可能觉得这没什么,但仔细一看,这颗芯片用的是成熟自主工艺,通用计算性能对标自家上一代的 3C5000。其实就是,龙芯在用更便宜的制程做出差不多的性能,这背后是架构层面的优化,不是靠堆工艺。 好了,进入今天的正题。 一、DeepSeek 启动大规模招聘,所有部门规模至少翻倍DeepSeek 官宣启动大规模招聘,计划将所有部门的规模扩大至少一倍。 这个消息一出,圈内人都在讨论一个问题,DeepSeek 到底在憋什么大招? 从公开信息看,DeepSeek 的推理模型已经打出了名气,V3 和 R1 系列在开源社区的口碑相当不错。现在大规模扩招,说明他们不只是想做模型,而是想把整个生态铺开。 坦率的讲,国内 AI 公司里,真正有技术信仰的团队不多,DeepSeek 算一个。这次扩招,值得关注他们接下来的动作。 二、0.7nm 制程芯片问世,摩尔定律又活了这可能是今天最硬核的一条新闻。0.7nm 制程芯片正式问世,意味着摩尔定律在被认为”已死”之后,又一次被续命了。 你想想看,...
AI日报 | 2026年6月27日
今天 AI 圈发生了一件大事,大到让我觉得有必要重新审视整个行业的走向。 OpenAI 发布了 GPT-5.6 系列,Anthropic 的 Mythos 5 被美国政府放行,两条消息几乎同时砸出来。但真正让我愣住的,不是模型有多强,而是「谁被允许用」这个问题。 🔥 重点新闻1. OpenAI 发布 GPT-5.6 系列,但你用不了GPT-5.6 系列今天正式亮相,三款模型各司其职。 Sol(旗舰版),Terminal-Bench 2.1 标准模式 88.8%,超过 Claude Mythos 5 的 88.0%,Ultra 模式更是冲到 91.9%。定价 $5/$30(输入/输出,每百万 token) Terra(均衡版),性能接近 GPT-5.5 但成本减半,$2.5/$15 Luna(速度版),$1/$6,主打高吞吐低延迟 听着很美对吧?但 OpenAI 在公告里写了一句让人不太舒服的话,「应美国政府要求」,目前仅向一小部分「可信合作伙伴」开放,普通开发者几周后才有机会。 来源,OpenAI 官方博客 HN 上 805 po...
科技简报 | 2026年6月26日
指甲盖大小的芯片上塞进 1000 亿个晶体管。 IBM 昨天扔出的这颗炸弹,把整个半导体行业的预期又往前推了一截。0.7 纳米节点,全新三维纳米堆叠架构,密度是 2021 年 2nm 技术的将近 4 倍。说实话,摩尔定律被宣判死刑已经好几年了,但 IBM 似乎没收到通知。 今天这份简报,我们从这颗芯片聊起,再看看 AI 经济的真实体量、开发者工具的最新战场,以及几家大厂各自在忙什么。 1. IBM 拿出亚纳米级芯片,0.7nm 节点首次亮相IBM 宣布推出全球首款亚纳米级芯片技术,采用 0.7nm(7 埃米)节点和全新的三维纳米堆叠(nanostack)架构。指甲盖大小的芯片上集成了将近 1000 亿个晶体管,密度大约是 IBM 2021 年展示的 2nm 技术的 4 倍。 你想想看,从 2nm 到 0.7nm,中间跨了好几个技术代际。业界一直在讨论「物理极限」这件事,但 IBM 这次用 nanostack 架构绕了一条路——不是继续把晶体管做小,而是往上堆。 坦率的讲,这还只是实验室阶段,离量产还有距离。但方向已经很清楚了,三维堆叠大概率是后摩尔时代的主赛道之一。 来源,Ha...
AI日报 | 2026年6月26日
美国政府亲自下场,叫停了 GPT-5.6 的全面发布。 你没看错,不是监管机构发警告,不是国会开听证会,而是政府直接跟 OpenAI 说,这个模型你先别放出来,得一个客户一个客户地审批。 这事有多离谱?我跟你说,从 GPT-3 到 GPT-5.5,从来没有哪个模型的发布需要政府逐个审批合作伙伴。但 GPT-5.6 做到了。 🔥 重点新闻1. 美国政府要求 OpenAI 暂缓 GPT-5.6 广泛发布The Information 报道,美国政府因安全顾虑要求 OpenAI 暂缓 GPT-5.6 的全面发布,改为受控预览版。OpenAI 计划先向小部分合作伙伴提供早期访问,由政府逐客户审批准入。 主要担忧集中在自动化高技能网络工作领域,这个模型既能帮防御者更快发现漏洞,也可能被攻击者用于加速漏洞利用测试。CEO Sam Altman 已于本周四向员工确认了该审批流程。 坦率的讲,这件事的信号意义远大于事件本身。它标志着 AI 从「行业自律」阶段正式跨入「政府介入」阶段。以前是公司自己决定放不放,现在是政府说你能不能放。 这让人想起核技术的发展轨迹,当一种技术强大到一定程度,它...
科技简报 | 2026年6月25日
字节跳动昨天在火山引擎 FORCE 大会上一口气放了好几个大招,豆包专业版上线、Agent Ready 基础设施发布、AI Coding 实践数据曝光,信息量相当大。再加上阿里 Qwen 开源了世界模型,OpenAI 和博通联手造芯片,今天的科技圈确实有点热闹过头了。 挑了 8 条值得聊的,一条一条来。 字节 AI 代码贡献率涨了 6 倍,但别急着高潮字节技术副总裁洪定坤在 FORCE 大会上分享了一组数据,过去一年字节内部 AI 代码贡献率增长了 6 倍,tokens 消耗增长了 5 倍。 听着很猛对吧?但他自己也说了,过度关注单一指标可能失真。TRAE 团队代码超过 90% 由 AI 生成,可人均需求吞吐率只提升了 60%。 这个差距挺有意思的。90% 的代码是 AI 写的,但产出只多了 60%,中间那 30% 的差值去哪了?大概率花在了 review、调试、以及「AI 写的代码看着对但跑起来有问题」这类事情上。 坦率的讲,这才是 AI Coding 真实的状态,不是「AI 帮你写完所有代码你就自由了」,而是「AI 帮你写了初稿但你得花时间改」。洪定坤能把这个数据公开说出来...
AI日报 | 2026年6月25日
OpenAI 自己造芯片了。不是传闻,不是投资,是跟 Broadcom 联合推出了一款叫 Jalapeño 的定制 AI 芯片。同一天,ChatGPT 的语音功能也迎来了上线以来最大规模的升级。 今天这两件事放在一起看,有点意思。 🔥 重点新闻1. OpenAI 与 Broadcom 发布定制芯片 JalapeñoOpenAI 终于迈出硬件这一步了。跟 Broadcom 联合推出的 Jalapeño,是一款专为大语言模型推理优化的定制芯片。 你想想看,一家以模型能力著称的公司,现在要自己做芯片,这背后的逻辑其实很清晰,推理成本是大模型商业化最大的瓶颈之一。谁能把推理成本打下来,谁就能在价格战里活得更久。 这事对 NVIDIA 来说不是什么好消息。虽然短期内不可能撼动 NVIDIA 的地位,但信号已经很明确了,大厂们不想把命运押在单一供应商身上。 来源,OpenAI 官网 2. ChatGPT 语音大幅升级,双向语音模型 Bidi 1 上线ChatGPT 的语音功能终于像个真正的对话了。新的 Bidi 1 模型支持双向语音,也就是说你可以边说它边听,中途打断它也没问题。 有用...
科技简报 | 2026年6月24日
Anthropic 昨天深夜放出了 Claude Code 的大升级,Karpathy 直接发了条长推说这是「LLM 的第三次变革」。 第一次是预训练,第二次是 RLHF,第三次是什么呢?Karpathy 说的是「LLM 学会使用工具」。这次 Claude Code 的升级核心就是 agent 能力的大幅提升,不只是写代码,而是能自主规划、执行、调试一整套流程。 我自己的感受是,过去半年 coding agent 的进化速度确实快得有点离谱。从最初的「能跑通 hello world」到现在的「能独立完成中等复杂度项目」,中间只隔了大概半年时间。 字节掀桌,豆包 2.1 成本暴砍 80%字节跳动的豆包模型升级到了 2.1 版本,两个数据很扎眼,API 成本直接降了 80%,编程能力追平 Claude Opus 4.7。 你想想看,结果会怎样呢。一个国内大厂的模型,在编程这个硬核领域跟 Anthropic 的旗舰打平了,同时价格只有对方的五分之一。这对整个开发者生态的冲击会非常大,尤其是国内的独立开发者和小团队。 坦率的讲,价格战这件事字节一直很擅长。但这次不一样,这次不是靠补贴硬打...
AI日报 | 2026年6月24日
今天早上刷到一条消息,差点把咖啡喷出来,谷歌有个干了快7年的工程师,因为自己动手写了个开源 CLI 工具,被直接开除了。这事儿在 Hacker News 上炸了,254 个评论,大家都在骂。 然后我往下刷,发现今天的 AI 圈简直像开了加速器,Claude 要当你同事了,字节把豆包成本砍了 80%,连马斯克都给自家卫星 AI 起了个名字叫 STARMIND。 一天之内这么多事,挑几个真正值得聊的。 🔥 重点新闻1. Claude 正式加入你的 Slack 频道,当同事了Anthropic 今天发布了 Claude Tag。这不是什么聊天机器人插件,而是让 Claude 以团队成员的身份加入 Slack,拥有独立账号。 你可以在频道里 @Claude,让它拆解任务、写 PR、跑数据分析、处理故障。频道内的 Claude 实例可供多人接力使用,还能积累上下文。开启环境模式后,它会主动跟进沉寂线程并提醒相关信息。 坦率的讲,这和之前那些「在 Slack 里加个 AI 助手」的产品思路完全不同。之前的逻辑是「人类问,AI 答」,Claude Tag 的逻辑是「AI 就是团队成员,有...
科技简报 | 2026年6月23日
小米的 YU7 GT 在纽北跑出自动驾驶圈速纪录了。10 分 29 秒,全程无人,纽北官方为此专门新增了「自动驾驶」分类。 这个事儿挺有意思的。一家中国车企,不是在刷量产车圈速,而是在极限赛道上验证自动驾驶系统。纽北 20 多公里、170 多个弯道,对感知和决策的要求比城市道路高几个量级。小米的说法是「在极限赛道中锤炼动态模型」,这话听着有点营销味,但逻辑本身是成立的,赛道是最极端的 corner case 集合。 微信 Agent「小微」开始灰度内测微信的 AI Agent 终于来了。 主入口在微信首页左上角,目前能做的事包括,给好友发消息和红包(需要确认)、创建日程提醒、待办、总结朋友圈,还能打通公众号和视频号的内容。 不过真正让人在意的是子入口。群聊和私聊里会出现「问小微」选项,这个入口可以读取聊天记录,还能群发消息。你想想看,小微的上下文能力会非常强,它不只是一个通用助手,它能拿到你的社交关系和对话历史。 目前还在灰度阶段,功能受限。但方向很清楚了,微信要做的是一个嵌入社交场景的 AI Agent,不是独立的聊天机器人。 美团 tabbit 国际版免费接入旗舰模型美团悄悄...




