这两天 Anthropic 一口气办了两件大事:发布新一代旗舰级 Sonnet 模型 Claude Sonnet 5,同时让此前被美国政府一纸出口管制令叫停的 Claude Fable 5(以及军方/防务专用的 Mythos 5)重新在全球上线。
Claude Sonnet 5:性能逼近 Opus 4.8,价格几乎腰斩
6 月 30 日,Anthropic 发布 Claude Sonnet 5,定位是"迄今为止最能干活的 Sonnet"。
Sonnet 5 与 Sonnet 4.6、Opus 4.8 的各项评测分数对比
- 能力提升:相比上一代 Sonnet 4.6,在推理、工具调用、编程和知识型工作上都有明显进步;能更自主地规划任务、调用浏览器/终端等工具,长任务里"跑到一半就停"的问题明显改善,会更主动地自我核查输出。
- 跑分表现:在 agentic search、computer use 等评测上全面超过 Sonnet 4.6,整体能力已经贴近 Opus 4.8,但成本低得多;幻觉率和"讨好式回答"(sycophancy)比 4.6 更低。
BrowseComp 评测下,不同 effort 档位的成本-性能曲线
- 安全侧数据:在 Firefox 漏洞利用测试中拿到 0% 成功率(即无法独立开发出可用的漏洞利用代码)。
网络安全评测:各代模型开发 Firefox 漏洞利用的成功率
- 价格:introductory 价 $2 / M input、$10 / M output(截止到 2026 年 8 月 31 日),之后恢复标准价 $3 / M input、$15 / M output。
- 可用性:已成为 Free / Pro 计划的默认模型,Max / Team / Enterprise 用户同样可用;API 模型 ID 为
claude-sonnet-5,同时上线 Claude API、Claude Code、Claude Platform 和 Claude.ai。
一位早期测试者的评价:「Claude Sonnet 5 比前代明显更 agentic,能以很有竞争力的价格完成需要持续多步操作的工作。」
Claude Fable 5:出口管制解除,带着新的安全限制回来了
背景是:6 月 12 日,美国商务部以"国家安全"为由,向 Anthropic 下达出口管制令,要求暂停所有外国公民对 Fable 5 / Mythos 5 的访问——由于无法实时区分用户国籍,Anthropic 索性对全球所有用户关闭了这两个模型(详见论坛之前的帖子)。起因是亚马逊的研究人员发现了一种绕过 Fable 5 安全防护的方法,能诱导模型定位并演示软件漏洞的利用方式。
这次的进展:
- 6 月 30 日:出口管制解除。
- 7 月 1 日:Fable 5 在 Claude Platform、Claude.ai、Claude Code、Claude Cowork 上全球重新开放。AWS、Google Cloud、Microsoft Foundry 上的访问权限正在陆续恢复中。
- 新的安全措施:Anthropic 针对亚马逊报告的那种绕过手法部署了改进后的安全分类器,声称能拦截 99% 以上的相关请求;被拦截时用户会收到提示,请求会自动转给 Opus 4.8 处理。同时刻意扩大了"安全边际"——哪怕多误伤一些正常请求,也要堵死被越狱后触及危险能力的路径。
Anthropic 的安全分类器如何将请求分为良性/模糊/有害,以及"安全边际"的作用方式
- 用量限制:截至 7 月 7 日,Pro / Max / Team 及部分 Enterprise 计划下,Fable 5 的用量计入周用量额度的最多 50%;7 月 7 日之后改为消耗 usage credits。
- 行业动作:借着这次事件,Anthropic 联合 Amazon、Microsoft、Google 在推进一套行业共识的"越狱严重程度"评估框架,从能力增益、能力增益覆盖面、武器化难易度、可发现性四个维度衡量越狱风险。
参考来源:
- Introducing Claude Sonnet 5 - Anthropic 官方
- Anthropic launches Claude Sonnet 5 as a cheaper way to run agents - TechCrunch
- Redeploying Claude Fable 5 - Anthropic 官方
- Claude Fable 5 Returns, Anthropic Launches Sonnet 5 - it-connect.tech
- U.S. Lifts Restrictions On Anthropic's Mythos 5 And Fable 5 AI Models - Forbes



