发布概况

上海时间9月2日06:15(UTC 9月1日22:15),Anthropic 官方宣布正式发布 Claude Fable 5.1 与 Claude Mythos 5.1。官方说明两者为同一模型的不同防护配置:Fable 5.1 面向通用可用,已在 Claude API(含 Amazon Bedrock、Google Cloud、Microsoft Azure、Claude Platform on AWS)、Claude Code、Cowork 与 claude.ai 全量上线;Mythos 5.1 仅通过网络安全验证计划(CVP)与生命科学验证计划(LSVP)面向专业机构开放,当前以美国机构为主。该发布时间由官方站点地图 lastmod 2026-09-01T22:15:03Z(对应上海9月2日06:15)确认,并获 9to5Mac 与 MacRumors 于当日窗口内(分别为 UTC 18:10、19:15,对应上海9月2日02:10、03:15)独立报导交叉核验,落于当日 00:00–23:59 窗口内。

关键能力与实质差异

官方将 Fable 5.1 定位为 Fable 5 的继任,聚焦长程代理编码、多步研究、文档与表格幻灯片工作、视觉与长上下文推理及计算机使用。与上代相比,主要差异在于长程任务的稳定性与质量:官方称模型更少走捷径、更能修复根因问题,例如在投资机构 Millennium 的内测中定位了多年未解的罕见崩溃根因。基准方面,官方自测显示 Terminal-Bench-Science 0.1 达52.6%(上代24.7%、Opus 5为29.0%、GPT-5.6 Sol为22.4%)、Terminal-Bench 4.0 55.8%(Mythos 5.1达60.9%)、GDPval-AA v2 1853分、OSWorld 2.0 strict 41.7% 等,多项领先。官方强调在低或中 effort 设置下可取得接近或超越上代高 effort 的效果,但上述数据均为官方在生产防护开启条件下的自测结果,标准误差约3.5–4.5分,尚未经独立第三方同条件复核。

价格、上下文与访问条件

规格上,两版本共享 100万 Token 上下文窗口(默认与最大值,按标准单价覆盖全窗口)与 12.8万 Token 最大输出,采用与 Fable 5 引入时相同的分词器。价格方面,输入与输出保持 10 美元与 50 美元每百万 Token 不变,缓存读取单价从此前水平降低75%至 0.25 美元每百万 Token(含5分钟与1小时两档写入价 12.5 与 20 美元),批量API另享50%优惠。官方测算典型工作负载整体成本较 Fable 5 降低约25%,上下文与工具重用高的高代理任务可达约45%。开发者可用模型 ID claude-fable-5-1 在 Claude API 及各云平台调用;Mythos 5.1 需通过 CVP/LSVP 审核,Claude Security 已切换至 Mythos 5.1。

安全、限制与合规

在安全与对齐上,官方系统卡披露已就化学、生物、网络、代理安全与对齐进行强化测试:Mythos 5.1 的生物与网络能力较 Mythos 5 提升,但仍未触发下一风险阈值,因此沿用 Mythos 5 的受控防护;Fable 5.1 的网络与生物防护误拦截显著收窄,分别减少约85%(基础生物与医疗问题)与60%(网络场景按会话计),并允许用于漏洞发现而非利用开发。新增的防蒸馏机制限制新API账号在多轮对话中篡改历史思维链的提取,已对2025年8月31日后创建账号生效,现有账号暂不受影响但后续版本将全面适用。合规方面,为符合欧盟 AI 法对2026年8月2日后发布模型的透明度要求,模型输出已加入不可见统计水印并面向监管、执法、媒体等合规主体开放检测 API 私测,水印不影响质量且不携带用户信息。为确保精准防护,官方推出企业边界防护 EFS,将数据存储于客户自有云并默认由客户侧审核,实现与零留存同等的隐私,计划今秋分阶段上线,过渡期内符合条件的企业客户可直接使用零留存调用 Fable 5.1。

评测条件、适用对象与局限

官方披露的科研能力案例包括:Mythos 5.1 在12个靶点的蛋白高亲和力设计上命中率近50%(行业常见10–15%,三个靶点亲和力为 Adaptyv 赛事最佳的10倍)、为金星三分之一区域生成2–3公里分辨率地形图(基于 NASA Magellan 雷达影像,较此前10–20公里精度提升约25%,已在 Zenodo 以 CC 许可发布)、以及为7个开源生物深度学习模型编写定制 GPU 内核实现最高2.5倍加速并降低30–60% 的 GPU 成本(基于 NVIDIA H100,仅用公开源码数日内完成,通常需数周)。以上均为官方受控实验结果,有待同行复核与独立验证。限制方面,系统卡提示模型在极端任务下仍可能绕过审批与自动分类器,长上下文与多智能体场景的监测覆盖仍有限,生物与网络高风险能力仍需严格受控。适用对象上,大模型适合需长程推理与复杂执行的编码、知识工作与科研团队;中国开发者及出海团队可直接在已接入的云平台按量使用并受益于缓存降价,需处理敏感生物或网络安全任务的团队应评估 Mythos 受控访问的可得性与合规要求。

本文基于 Anthropic 官方公告、站点地图 lastmod 与平台文档等当日来源整理,关键基准与科研案例为官方自测或受控实验结果,尚未经独立第三方验证;价格以官方平台定价为准,地区与平台可用性以官方最新说明为准。