Anthropic 发布 Claude Sonnet 5,同时全球重新开放 Claude Fable 5

这两天 Anthropic 一口气办了两件大事:发布新一代旗舰级 Sonnet 模型 Claude Sonnet 5,同时让此前被美国政府一纸出口管制令叫停的 Claude Fable 5(以及军方/防务专用的 Mythos 5)重新在全球上线。


Claude Sonnet 5:性能逼近 Opus 4.8,价格几乎腰斩

6 月 30 日,Anthropic 发布 Claude Sonnet 5,定位是"迄今为止最能干活的 Sonnet"。


Sonnet 5 与 Sonnet 4.6、Opus 4.8 的各项评测分数对比

  • 能力提升:相比上一代 Sonnet 4.6,在推理、工具调用、编程和知识型工作上都有明显进步;能更自主地规划任务、调用浏览器/终端等工具,长任务里"跑到一半就停"的问题明显改善,会更主动地自我核查输出。
  • 跑分表现:在 agentic search、computer use 等评测上全面超过 Sonnet 4.6,整体能力已经贴近 Opus 4.8,但成本低得多;幻觉率和"讨好式回答"(sycophancy)比 4.6 更低。


BrowseComp 评测下,不同 effort 档位的成本-性能曲线

  • 安全侧数据:在 Firefox 漏洞利用测试中拿到 0% 成功率(即无法独立开发出可用的漏洞利用代码)。


网络安全评测:各代模型开发 Firefox 漏洞利用的成功率

  • 价格:introductory 价 $2 / M input、$10 / M output(截止到 2026 年 8 月 31 日),之后恢复标准价 $3 / M input、$15 / M output。
  • 可用性:已成为 Free / Pro 计划的默认模型,Max / Team / Enterprise 用户同样可用;API 模型 ID 为 claude-sonnet-5,同时上线 Claude API、Claude Code、Claude Platform 和 Claude.ai。

一位早期测试者的评价:「Claude Sonnet 5 比前代明显更 agentic,能以很有竞争力的价格完成需要持续多步操作的工作。」


Claude Fable 5:出口管制解除,带着新的安全限制回来了

背景是:6 月 12 日,美国商务部以"国家安全"为由,向 Anthropic 下达出口管制令,要求暂停所有外国公民对 Fable 5 / Mythos 5 的访问——由于无法实时区分用户国籍,Anthropic 索性对全球所有用户关闭了这两个模型(详见论坛之前的帖子)。起因是亚马逊的研究人员发现了一种绕过 Fable 5 安全防护的方法,能诱导模型定位并演示软件漏洞的利用方式。

这次的进展:

  • 6 月 30 日:出口管制解除。
  • 7 月 1 日:Fable 5 在 Claude Platform、Claude.ai、Claude Code、Claude Cowork 上全球重新开放。AWS、Google Cloud、Microsoft Foundry 上的访问权限正在陆续恢复中。
  • 新的安全措施:Anthropic 针对亚马逊报告的那种绕过手法部署了改进后的安全分类器,声称能拦截 99% 以上的相关请求;被拦截时用户会收到提示,请求会自动转给 Opus 4.8 处理。同时刻意扩大了"安全边际"——哪怕多误伤一些正常请求,也要堵死被越狱后触及危险能力的路径。


Anthropic 的安全分类器如何将请求分为良性/模糊/有害,以及"安全边际"的作用方式

  • 用量限制:截至 7 月 7 日,Pro / Max / Team 及部分 Enterprise 计划下,Fable 5 的用量计入周用量额度的最多 50%;7 月 7 日之后改为消耗 usage credits。
  • 行业动作:借着这次事件,Anthropic 联合 Amazon、Microsoft、Google 在推进一套行业共识的"越狱严重程度"评估框架,从能力增益、能力增益覆盖面、武器化难易度、可发现性四个维度衡量越狱风险。

参考来源

自己实测了一下这两个模型,分享一点日常使用体验:

Fable 5:日常场景下感觉提升不算明显,而且速度非常慢,经常要想很久才出结果。官方定位它主打的是长程自主执行、复杂推理这类"超纲"任务。所以普通场景下用它,多等的时间基本换不来体感上的提升,有点杀鸡用牛刀的感觉。

Sonnet 5:我平时主要写中等规模项目的代码,最近降到了 Pro 。实际用下来 Sonnet 5 挺"耐用"的——同样的额度能撑更久,日常改代码、跑测试这些高频操作交给它完全够用,质量也贴近 Opus。

感谢实测分享!Fable 5 确实更适合长程任务,日常用性价比不高。Sonnet 5 的"耐用"特性挺实用的,Pro 额度吃紧的时候尤其明显——质量够用、消耗更少,算是日常干活的甜点区。