AI Daily Digest: Cerebras CS-4 机架化宣战 GPU,Mojo 开源定军心 - 2026/08/19
今天的 AI 圈焦点在基础设施与开源生态两条线:Cerebras 发布第四代晶圆级系统 CS-4,从单体盒子转向模块化机架架构,直接对标 Nvidia NVL72 与 AMD Helios;被 Qualcomm 收购的 Modular 交出信任答卷——Mojo 语言以 Apache 2.0 全面开源。学术方面,知识与推理解耦的新架构 Intern-S2-Mobius、以及长程 Agent 的可恢复执行,都指向同一个主题:从"更大模型"转向"更聪明的系统结构"。
Cerebras CS-4:晶圆级推理进入机架化时代
Cerebras 发布第四代系统 CS-4,HN 上 396 分引发热议。核心规格:基于三颗新的 WSE-3 Turbo 晶圆级处理器,宣称推理速度最高达 GPU 系统的 30 倍,吞吐每瓦较上代提升 10 倍。
最有意思的细节是 WSE-3T 并非新硅片——工艺、晶圆面积、晶体管数、核心数、SRAM 容量全部不变,性能翻倍来自供电与散热技术的进步让现有晶圆能以翻倍时钟运行。21.6 PB/s 的内存带宽优势(官方称比 Nvidia/AMD 最好的 GPU 快 1000 倍)得以延续,而内存带宽正是推理速度的真正瓶颈。
架构层面 CS-4 完成了从单体系统到模块化机架的转身,与 Nvidia NVL72、AMD Helios 同一思路:Wafer-Scale Backpack 把供电转换、直接液冷、高速 I/O 折叠成晶圆旁的三维封装,计算、供电、布线解耦,部署维护升级都更方便。新的可编程 I/O 子系统带宽翻倍,同时支持开放生态连接与 Cerebras 系统间直连。路线图承诺每年性能翻倍、2027 年吞吐提升 20 倍,下一代晶圆级引擎已与名为 Nexus 的新机架平台协同设计。
来源:Cerebras 官方博客、The Register(2026-08-19)
Mojo 全面开源:Qualcomm 收购后的信任答卷
Modular(Chris Lattner 创办,6 月宣布、7 月 29 日完成被 Qualcomm 收购)在 ModCon 2026 宣布:Mojo 语言以 Apache 2.0 许可(含 LLVM 例外)全面开源,编译器、工具链及构建所需的一切全部进入 modular GitHub 仓库,用 Bazel 一条命令即可从源码构建。
这次开源的时机耐人寻味。8 月 11 日 Mojo 刚发布 1.0,提供稳定的生产级语言基线;而社区对芯片厂商收购的最大疑虑正是供应商中立性——如果 Mojo 要跨硬件厂商扮演角色,开发者必须信任 Qualcomm 不会把生态往自家芯片上带。The Register 此前就指出"开源编译器发布将是打消疑虑的关键"。现在答卷交了,接下来看社区是否买单。Windows 支持也已在计划中,与现有 macOS/Linux 并列。
来源:Modular 官方博客、Phoronix(2026-08-18)
知识与推理解耦:Intern-S2-Mobius 架构
arXiv:2608.14290 提出 Mobius-v0 架构,把 Transformer 的两个组件重新分工:全局共享的记忆模块(FFN)存储知识向量,多个推理器(Self-Attention)迭代查询记忆完成组合推理,隐藏状态同时充当缓存与载体,知识向量在推理算子间往复传输。
数据很有说服力:从头训练的 7B 版本只用 62.6% 的训练数据就达到 7B Transformer 基线的同等下游效果;从 Qwen3.5-35B 持续预训练的 Intern-S2-Mobius 在效果相当的同时,端到端推理加速近 4 倍。作者阵容(Ning Ding、Dahua Lin、Wenwei Zhang 等)也值得注意。在推理成本成为落地瓶颈的当下,"知识-推理解耦"提供了一条不靠堆参数的扩展路径。
来源:arXiv:2608.14290(2026-08)
