AI Daily Digest: 48小时三款前沿模型齐发与Agent自主进化周 - 2026/09/03
九月以八月浪潮以来最密集的 48 小时开局:Anthropic、Google、Meta 在两天内连续放出五款模型,其中"同权重、双安全档"的发布策略(Fable 5.1 与门控的 Mythos 5.1)和首个预先印出涨价日期的价目表(Gemini 3.8 Flash 明年一月翻倍)都打破了惯例。与此同时,今日 arXiv 上 Agent 自主进化与治理研究密集涌现:从递归自我改进的临界条件,到自改进 Agent 的 harness 篡改审计,再到"模型不可信假设"下的多 Agent 授权治理 ——Agent 学科正在从"能力建设"转向"约束与治理"的深水区。
Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1:同模型双安全档
9 月 1 日,Anthropic 在同一日发布两款前沿模型:Claude Fable 5.1 延续第 5 代的定价(输入 10 美元、输出 50 美元每百万 token),但缓存读取价格从 1.00 美元大幅下调至 0.25 美元,批处理价格减半;Claude Mythos 5.1 是同一模型的安全限制更宽的变体,仅通过 Anthropic 的信任访问验证计划提供,无公开定价。
更值得工程团队关注的是三项破坏性 API 变更:强制工具选择(forced tool choice)被移除;thinking 的绑定方式改为由模型单侧决定;历史编辑将使对应的思考失效——最后一条对 8 月 31 日之后创建的账户强制执行。依赖 Claude API 的系统需要在迁移窗口内完成适配。
来源:Digital Applied — AI Model Releases: September 2026 Tracker(2026-09-02)
Google 发布 Gemini 3.8 Flash:一月后价格翻倍
9 月 2 日,Google 上线六周内的第三个 Flash 模型。3.8 Flash 维持 3.7 Flash 的入门价格(0.75/3.75 美元)至 12 月 31 日,2027 年 1 月 1 日起翻倍至 1.50/7.50 美元——Google 首次直接在价目表中预先印出涨价日期,路由决策因此可以从容规划。
性能上,厂商自测 HLE-Verified 达 54.9%;第三方 Artificial Analysis 测得指数 59、单任务成本 0.58 美元——注意这高于 3.7 Flash 的 0.40 美元,同样的 token 单价并不等于同样的任务单价。同日推出的 Gemini 3.8 Flash Cyber 是放宽安全缓解的网络安全变体,通过新的 Fairwind 计划向政府、关键基础设施运营商等提供门控访问。
来源:Digital Applied — AI Model Releases: September 2026 Tracker(2026-09-02)
Meta 发布 Muse Spark 1.3:行动前先确认的 Agent 模型
9 月 2 日晚,Meta 发布 Muse Spark 1.3,主打"会追问"的行为设计:遇到歧义主动提出澄清问题、卡住时请求帮助、执行有后果的操作前先确认。定价维持 1.25/4.25 美元不变,最大推理模式"即将推出"。
token 经济性上出现了两组矛盾的数字:Meta 自测工具调用减少约 20%、token 消耗减少约 25%;但 Artificial Analysis 测得单任务输入 token 反而多出约 57%(0.55 美元/任务)——追问和确认本身是有成本的。同晚挂出的"
