AI Daily Digest: OpenAI 自研芯片能效反超 Nvidia、Mechanical Turk 谢幕、GRPO 有了新对手 - 2026/08/26
今天的头条属于硬件与基础设施:SemiAnalysis 拿到 OpenAI 首款自研推理芯片 Jalapeño 的完整数据——700W 功耗跑出 13.4 PFLOPs,能效比达到 Nvidia 的 1.5-1.9 倍;Apple 同日发布首款 2nm M6 与四芯 M5 Ultra,端侧 512GB 统一内存让本地跑 200B+ 模型成为可能。软件侧,运营 21 年的 Mechanical Turk 宣布 9 月底关闭,"人工的人工智能"被真正的人工智能替代。学术前沿上,BPCO 证明精心设计的 Critic 可以用单次采样匹敌 GRPO,RENDER 则揭示记忆评测中"喂给模型什么形态"与"检索到什么"同样重要。
SemiAnalysis 深度解析 Jalapeño:OpenAI 自研芯片能效反超 Nvidia
OpenAI 与 Broadcom 合作的首款定制推理芯片 Jalapeño,16 个月就在 TSMC N3P 完成流片。SemiAnalysis 的深度分析给出关键数字:B0 版本在 700W 功耗下实现 13.4 PFLOPs 的 MXFP4 算力(Nvidia Rubin 需要 900-1150W),搭配 15.4TB/s 的 HBM4;实际推理中 DeepSeek R1 单用户吞吐超 700 tok/s,GPT-OSS 约 1400 tok/s。OpenAI 自测显示,在 GPT-OSS、DeepSeek R1、Kimi K2.5 1T 三组负载上,Jalapeño 的每瓦特工作量是 Nvidia 芯片的 1.5-1.9 倍。
这意味着自研推理芯片的叙事从"降低成本"升级为"性能反超"。当超大规模厂商能用不到两年时间流片出能效领先的推理芯片,Nvidia 的护城河就需要重新评估——芯片设计能力正在向云厂商扩散。
来源:SemiAnalysis(2026-08-26)
