Anthropic 在 9 月 22 日放出了 Claude 5.5 家族的第一个模型 Opus 5.5,官方口径给得直接,在大多数工作上达到 Claude Fable 5.1 的水平,典型工作负载的成本比上一代 Opus 5 低四成。API 价格同步下调,这在旗舰模型的价格走势里算是少见的方向。我把官方公告、定价页和两边的社区反馈都过了一遍,这篇把性能、价格与真实口碑说清。
主要功能
Opus 5.5 定位家族旗舰,接替 Opus 5,Sonnet 与 Haiku 的 5.5 版本官方称数周内跟进。能力层面全是官方自称的基准数字。Terminal-Bench 4.0 拿 66.4%,对比 GPT-6 Astra 的 57.9% 与 Opus 5 的 52.3%。FrontierCode 主榜 54.4%,官方称以约两成的单任务成本胜过 GPT-6 Astra。GDPval 智能指数 1846 的 Elo 对 Astra 的 1542 拉开了身位。长任务是宣传重点,68 万行代码的迁移一天内完成,20 万行的代码审计三小时出头,官方称换 Opus 5 要二十小时以上。
两个细节值得单独说。其一,官方基准表里没有 SWE-bench,也没有任何 Gemini 模型的对照,对比对象锁定 GPT-6 Astra 与 GPT-5.6 Sol,引用数据时注意口径。其二,Anthropic 自己在公告里提醒,基准分数的差距已经不能当作真实差距的可靠指引,与 Fable 5.1 的实际差距比表格显示的更小,厂商自曝到这个程度不多见。AutomationBench 上 40.0% 略低于 Astra 的 41.4%,这条也写在公告里。
新特性方面,思考档位分低到最高五档加自适应思考,思考模式不可关闭,输出带欧盟 AI 法案要求的水印。快速模式两倍价格换最高两倍半的速度,仅限 Claude Code 与第一方 API,网页聊天侧没有。代理场景的速率限制在订阅各档都有提高,五小时窗口的限额上调,API 侧新增可保存的限额重置点。反蒸馏的思考保留机制对八月三十一日之后新建的 API 账户默认生效,通信风格也改了,官方称更利落。合规选项里有零数据保留。
安全侧的第三方背书可以记一笔。预发布阶段由 Frontier Design 与 METR 做了外部测试,Gray Swan 的提示注入测试里它与 Fable 5.1 并列最低风险,越狱尝试官方称少了约 85%(自称)。代码质量的独立评估也有,SonarSource 的评测显示同等任务下它比上代少写 27.5% 的代码,通过率持平,代码更精简。
解决了什么需求
Hacker News 主帖一千七百多分,讨论的焦点就是性价比。km144 的总结代表了一批人,Fable 5.1 好但贵,Opus 5.5 同级智能便宜四成,是新的每日主力。paradoxo 的体验更具体,以前要十几个提示的活现在两三个搞定。Reddit r/ClaudeAI 的正面帖标题就叫 Claude 回来了,iliadz 称与 Opus 5 是白天和黑夜的差别,TheSeizor 从 Astra 搬回来,同一件事的提示数从四天三十八次降到三小时十一次。
另一边的声音也要听。负面帖把 5.5 比作当年的 4.6,抱怨草率、跳结论、被强制切换。adamleff 提醒快速模式只有 API 与 Claude Code 有,网页聊天没有两倍速。CClini 的追问很实际,价格降了,用量限额是不是也降了。kenjiiito 的调侃流传很广,从五美元降到四美元,我富了一美元。价格战的背景板也摆在评论里,theAnonymousone 认为 OpenAI 用 GPT-6 Sol 的低价逼出了这次降价,0xedd 则回敬说 OpenAI 已经做到九成智能加百分之五的价格。umanwizard 对官方长任务案例的质疑值得记,真实客户不会把三十万行代码真交给一个模型跑,宣传案例看看就好。还有一位哲学背景用户的体验帖给中性结论,对话更流畅,结论谨慎,日常写作的场景提升明显。
价格与注意事项
API 定价每百万 token 输入 4 美元输出 20 美元,比 Opus 5 的 5 与 25 下调约两成,缓存读取降到 0.2 美元。快速模式两倍价格换最高两倍半的速度,仅限 Claude Code 与第一方 API。订阅侧 Pro 每月 20 美元不变,Max 从 100 美元起。上下文长度官方公告未明写,按官方文档 4.6 之后模型标配百万 token 的口径推断应为 1M,第三方有 20 万的说法,以官方文档为准。
迁移建议分人群。重度编码且看中单位成本的,5.5 的账算得过来。对 Sol 这类低价模型满意的,差距没有大到值得多花钱。等 Sonnet 5.5 的用户再忍几周,届时中档价位的选择会更清楚。
总结
旗舰模型降价加性能维持,Opus 5.5 把 Anthropic 拉回了性价比讨论桌。基准表的口径要自己把关,社区的两极口碑提示切换前先拿自己的任务跑两天。对大多数开发者,这是一次成本向下的升级,方向总是对的。
来源
- Anthropic 官方公告 https://www.anthropic.com/news/claude-opus-5-5
- 官方定价文档 https://platform.claude.com/docs/en/about-claude/pricing
- 订阅价格页 https://claude.com/pricing
- Hacker News 讨论 https://news.ycombinator.com/item?id=49803892
- Reddit r/ClaudeAI 正面反馈 https://www.reddit.com/r/ClaudeAI/comments/1wnpit2/claude_is_back
- Reddit r/ClaudeAI 负面反馈 https://www.reddit.com/r/ClaudeAI/comments/1wo9lbs/opus_55_is_the_new_46
- SonarSource 第三方评测 https://www.sonarsource.com/blog/claude-opus-5-5-an-evaluation