Anthropic发布Claude Opus 5.5 成本降四成性能持平旗舰
Anthropic已发布Claude Opus 5.5,性能达到Claude Fable 5.1水平且运行成本降低40%,企业与开发者可直接获得更高性价比的大模型能力。
发布基本信息
Anthropic于2026年9月22日正式推出Claude 5.5家族的首款模型Claude Opus 5.5,这也是该公司在提出“前沿AI应放缓节奏”观点后发布的首个新一代模型[S1]。按照官方定位,Opus 5.5主要面向智能体编码、计算机使用、研究及专业知识工作等复杂任务场景,属于当前Opus产品线中能力最强的版本[S9]。
与以往单纯强调性能提升的发布不同,本次Opus 5.5将“性能持平高端模型+显著降低成本”作为核心卖点,并在发布后迅速完成全平台上线。用户可通过Claude官网、Claude Code命令行工具,以及AWS Amazon Bedrock、Google Cloud、Microsoft Azure等主流云服务调用该模型,API模型ID为claude-opus-5-5[S3]。
核心性能表现
以下性能数据主要来自Anthropic官方披露及早期合作方测试,尚未经全面第三方独立验证。
在性能层面,官方数据显示Claude Opus 5.5在大多数工作任务上已达到Claude Fable 5.1的水平,后者是Anthropic在2026年9月初发布的旗舰级模型[S2]。其中,智能体编码、长周期智能体任务和知识工作是提升最明显的领域。
具体到基准测试,Opus 5.5在Terminal-Bench 4.0编码测试中取得66.4%的得分,高于GPT-6 Astra的57.9%;在FrontierCode测试中得分为54.4%,同样高于GPT-6 Astra的53.3%[S3]。在知识工作类测试GDPval-AA v2.1中,该模型获得1846 Elo,表现超过Fable 5.1和GPT-6 Astra[S5]。
真实场景下,早期测试反馈显示Opus 5.5可在不到一天时间内完成68万行代码迁移,3小时内审计并修复20万行代码库,完成同类任务的速度明显快于前代Opus 5[S5]。对于长周期工程任务,模型能够持续无人值守运行超过18小时,自主梳理服务间通信逻辑并给出落地方案,返工率更低[S3]。
成本与效率优化
成本下降是本次发布最受关注的变化。Anthropic明确表示,在默认设置下,Claude Opus 5.5的典型工作负载运行成本较Claude Opus 5降低40%[S2]。这一降幅并非只来自单价下调,而是单价降低与任务效率提升共同作用的结果。
效率方面,Opus 5.5的输出生成速度比Opus 5快30%以上,且完成相同任务通常消耗更少的token和工具调用次数[S9]。第三方企业测试显示,在部分终端任务中,Opus 5.5所需步骤不到Opus 5的一半,token用量也显著减少[S11]。这意味着企业在实际部署中,不仅单位token价格更低,完成同一目标的总调用量也会下降。
定价细节与订阅权益
具体定价上,Claude Opus 5.5的普通模式API价格为每百万输入token 4美元、每百万输出token 20美元,相比Opus 5的5美元和25美元均下降20%[S9]。缓存读取价格降幅更大,从每百万token 0.50美元降至0.20美元,降幅达60%,对长对话、大型代码库等高缓存命中场景的成本优化尤为明显[S3]。
除普通模式外,该模型还提供快速模式选项,定价为每百万输入token 8美元、每百万输出token 40美元,最高可达到约2.5倍的输出速度[S9]。对于仅在美国区域进行推理的工作负载,输入和输出token定价为原价的1.1倍[S3]。
订阅用户权益方面,Pro、Max、Team等套餐用户可直接使用Opus 5.5,且五小时用量上限有所提高,订阅用户还额外获得一次可留存使用的额度重置机会[S5]。结合token效率提升,相同额度下用户可完成的工作量比使用Opus 5时明显增加。
安全与对齐能力
以下安全数据主要来自Anthropic官方披露及早期合作方测试,尚未经全面第三方独立验证。
作为Anthropic在“放缓前沿节奏”表态后发布的首个模型,Opus 5.5的安全机制也进行了升级。官方称其是首款在网络安全、生物学和反蒸馏方面配备与Fable 5.1同级防护措施的Opus模型,发布前已通过内部自动化行为审计和Frontier Design、METR等外部机构评估[S3][S10]。
在实际使用中,模型针对偏见推理、沙箱逃逸等潜在风险行为的识别能力有所增强,越界尝试频率明显降低[S5]。对于高风险领域请求,Anthropic采用动态路由机制,触发安全策略的请求会自动回退到更保守的旧版本模型,以平衡可用性与风险控制[S11]。此外,在Amazon Bedrock上调用Opus 5.5时默认不保留用户数据[S3]。
家族产品节奏
Claude Opus 5.5只是Claude 5.5家族的第一款产品。2026年9月28日,同家族第二款模型Claude Sonnet 5.5正式发布,定位为Opus 5.5的高速低成本补充,更适合边界清晰的日常任务、bug修复以及文档、幻灯片、表格制作等场景[S4]。
官方数据显示,Sonnet 5.5较Sonnet 5运行速度提升30%以上,多数工作的成本最高可降低30%[S4]。在Terminal-Bench 4.0智能体编码评测中,Sonnet 5.5得分达到70.6%,远高于Sonnet 5的10.3%,同时也是首款仅通过截图就能通关《宝可梦 红》的Sonnet系列模型[S4]。
按照Anthropic公布的路线图,面向高吞吐量、成本敏感型应用的Claude Haiku 5.5也将在未来几周内加入5.5家族,完成从高端到轻量的全价位覆盖[S4]。
行业影响与后续观察
Claude Opus 5.5的发布,标志着头部大模型厂商的竞争重点正在从单纯的性能突破,转向性能与成本效率的综合比拼。几乎在同一时期,OpenAI也推出了GPT-6 Sol和GPT-6 Luna两款低成本模型,均将降价作为核心卖点[S10]。这种同步性反映出,在企业客户越来越关注落地成本的背景下,“更高性能/更低成本”已成为行业共同的迭代方向。
对开发者和企业用户而言,Opus 5.5最直接的价值是让接近旗舰级的模型能力可以用更低成本规模化部署,尤其是在代码开发、知识处理和长周期智能体任务中,有望显著降低项目试错和运行成本。不过,由于模型默认开启自适应思考机制,旧应用若要从Opus 5无缝迁移到Opus 5.5,可能需要对工具路由、思考块处理等逻辑进行相应调整[S3]。
目前公开信息仍以官方发布内容为主,关于模型在更多行业场景下的真实表现、长期使用稳定性以及不同推理档位的性价比差异,还需要更多第三方评测和实际落地数据验证。后续值得关注的方向包括Haiku 5.5的具体发布时间与定价、企业客户的实际采用情况,以及其他头部厂商是否会进一步跟进降价策略。
制作记录
公开编辑轨迹,不含隐藏推理。
正在整理制作记录…
Reader Signal
这篇文章对你有帮助吗?
只收集预设选项,不开放评论,不公开展示个人反馈。
选择一个判断,也可以附加一个预设标签。
发布于 2026-10-04 07:03:03。本文由明确标注的 Aione AI 编辑 Agent 参与制作,未经授权不得转载,不构成投资建议。