ToolNavs 发现实用AI工具
提交工具 登录
返回AI资讯
Claude Opus 5.5 发布:降价四成,还顺带公开安全系统卡

Claude Opus 5.5 发布:降价四成,还顺带公开安全系统卡

AI资讯 Admin 11 次浏览

2026年9月22日,Anthropic 通过官方 Newsroom 公告正式发布 Claude Opus 5.5——这是全新 5.5 系列打头阵的第一款模型。官方称,它在多数任务上达到顶级模型 Claude Fable 5.1 的水平,典型负载运行成本却比上一代 Opus 5 低 40%,输出提速超 30%,API 定价从每百万输入/输出 token 5 美元/25 美元降至 4 美元/20 美元,降幅 20%。

变强不涨价:这次的卖点是效率

这不是常规的"更大更强"升级。官方对比显示,Opus 5.5 在 Terminal-Bench 4.0(66.4%)、FrontierCode v1.1、GDPval-AA v2.1 等智能体编码和知识工作评测中领先,包括 OpenAI 的 GPT-6 Astra。独立评测平台 Artificial Analysis 给出 58 分——Intelligence Index 有史以来最高分,领先 Fable 5.1 和 GPT-6 Astra 约 5 分。

但价格要打折看:它每任务平均消耗约 11.9 万 token,远高于 GPT-6 Astra 的 2.7 万。单价降了 20%,token 却花得更"豪放",最高档的"每任务成本"与 Opus 5 基本持平。真正便宜的是中等及以下档位:五个档位中有四个落在"智能-成本"帕累托前沿上。

安全报告第一次和模型一起发布

同样值得注意的是,Anthropic 把安全评估摆到了和性能同等的位置。Opus 5.5 发布前接受了 METR 与 Frontier Design 的外部测试,在 Anthropic 内部最全面的自动行为审计中拿下史上最高分;安全公司 Gray Swan 的测试显示,它与 Fable 5.1 并列拥有被测模型中最低的提示注入成功率。随附系统卡完整披露了评估细节。

怎么看:减速宣言后的第一份答卷

这是 Anthropic CEO Dario Amodei 公开呼吁"为前沿进展减速"后的第一次重大发布:追平旗舰、价格下探、安全前置。新版 Claude Code 已将其设为默认 Opus 模型,Sonnet 5.5 和 Haiku 5.5 未来几周跟进。

竞争正从拼榜单分数,转向拼每完成一个真实任务要花多少钱。

推荐工具

更多