AI Daily Digest: 腾讯 Hy4 开源冲击前沿与 Agent 治理架构 - 2026/08/30
今日焦点集中在开源模型竞争格局:腾讯混元团队开源 770B/49B 的 Hy4 preview,内部盲测小胜 GLM-5.3 与 Kimi K3,发布当日即登 HN 热榜;Nvidia 则把开源模型迭代周期压缩到 4-6 周。学术方面,受治理 Agent 的架构模式、RLVR 探索坍缩的弱模型解法、以及跨本体世界模型成为亮点。
腾讯开源 Hy4 preview:770B/49B MoE 冲击开源前沿
腾讯混元(Hunyuan)团队于 8 月 28 日发布并开源新一代大模型 Hy4 preview:总参数 770B、每 token 仅激活 49B 的混合专家(MoE)架构,上下文窗口超过 100 万 token,以 Apache 2.0 协议发布在 Hugging Face、ModelScope 等平台,同步提供 FP8 量化版本。
架构细节颇有看点:78 层中首层为稠密 FFN,其余 77 层采用 256 个路由专家(top-8)加 1 个共享专家;原生 MTP 层(10B 总参数/0.7B 激活)专门用于投机解码加速。注意力机制采用门控 DeepSeek 稀疏注意力(DSA)配合 IndexCache 跨层稀疏索引复用,再加 iHC 恒等超连接把残差信息通路拓宽到 4 条残差流。FP8 版本可在 16 张 B200 或 8 张 B300 上用 vLLM 0.29 部署,vLLM 官方 recipes 已提供 day-zero 支持。
性能方面,腾讯公布的内部工程任务盲测显示:Hy4 preview 平均分 2.99,小胜 GLM-5.3(2.92,胜率 46.8%)与 Kimi K3(2.94,胜率 51.2%)——是"温和但真实的领先"而非碾压,恰好印证三家已同处开源前沿第一梯队。发布当日 Hacker News 获得 206 分、131 条讨论,社区关注点集中在部署门槛(49B 激活参数的显存需求)与开源前沿竞争格局。
商业化配套:WorkBuddy 与 CodeBuddy 上 Hy4 preview 免费两周,Hy3 免费期延长至 9 月 30 日;API 通过腾讯云 TokenHub 与 OpenRouter 全球可用。
来源:Tencent 官方公告(2026-08-28)
Nvidia×Hugging Face:开源模型进入月度刷新节奏
据 8 月 24 日公布的访谈,Nvidia 应用深度学习研究 VP Bryan Catanzaro 确认 Nvidia 开源 AI 模型的迭代周期已从过去的 6-8 个月压缩到约 4-6 周一次,而硬件(Blackwell 等)仍按原有节奏发布。这一"软件月更、硬件年更"的分离策略意图明确:让开发者默认构建在 Nvidia 栈上。
本周的实例是 Nemotron 3.5 Lightning 登陆 Hugging Face,并在发布当日即支持 CoreWeave 推理(day-zero 部署)。当开源模型的发布节奏快过多数团队的评估周期时,"持续评估"将取代"事件式选型"成为工程团队的必修课。
来源:shattered.io 报道(2026-08-24)
学术前沿:Agent 治理、探索与物理仿真
今日论文来自 arXiv 8 月 27 日批次(周五提交、昨日未覆盖的六篇)。正值周日,arXiv 无新提交。
