返回深度
模型产品发布2026-09-23 07:06:306 min readAione Editorial V4

Anthropic发布Claude Opus 5.5 成本降40%性能追平Fable 5.1

Anthropic发布Claude Opus 5.5,性能追平Fable 5.1且典型任务成本降40%,开发者与企业可在多平台立即接入。

Aione AI 编辑部
Research · Writing · Review · Publishing
2026-09-23 07:06:30 6 分钟

Claude Opus 5.5 是 Claude 5.5 家族的首款模型 Anthropic 于 2026 年 9 月 22 日正式发布 Claude Opus 5.5,这是 Claude 5.5 家族推出的首款模型,定位为面向长时间编程智能体与复杂知识工作的主力前沿模型[S1][S4][S12]。官方将其描述为一次“非典型半代升级”:在多数任务上性能已达到更高阶的 Claude Fable 5.1 水平,但典型工作负载的运行成本较 Opus 5 降低约 40%,输出速度提升 30% 以上[S1][S2][S5][S8][S12]。

从产品节奏看,Anthropic 并未沿用上一代逐步迭代的命名方式,而是直接从 5.x 系列跳到 5.5 家族,并同步规划了 Sonnet 5.5 与 Haiku 5.5 两款后续型号,显示出其希望以“性能上探 + 成本下探”的组合策略快速覆盖不同层级市场[S2][S4][S6][S9][S11]。

编程与知识工作评测表现突出 在编程类评测中,Opus 5.5 展现出明显优势。Terminal-Bench 4.0 测试中,Opus 5.5 得分 66.4%,高于 GPT-6 Astra 的 57.9% 和 Opus 5 的 52.3%;FrontierCode v1.1 得分 54.4%,略高于 GPT-6 Astra 的 53.3%;CursorBench 4.0 得分 57.8%,较 Opus 5 的 46.6% 提升超过 11 个百分点[S5][S6][S7][S11]。

知识工作与电脑操作方面,GDPval-AA v2.1 基准中 Opus 5.5 获得 1846 Elo,超过 Fable 5.1 的 1735 和 Opus 5 的 1708;OSWorld 2.0 电脑操作评测从 Opus 5 的 74.0% 提升至 81.8%[S5][S6][S11]。不过,Opus 5.5 并非在所有项目上都领先,AutomationBench、Terminal-Bench-Science 等部分评测仍略低于 GPT-6 Astra,说明其在自动化流程与科学计算类任务上仍有提升空间[S4][S11]。

值得注意的是,官方公布的 68 万行代码迁移等案例来自早期测试者,并非标准化基准,实际效果会受到代码质量、迁移目标、测试覆盖率和人工介入程度等因素影响,普适性仍需更多独立验证[S3][S11]。

成本与速度优化明显 相比 Opus 5,Opus 5.5 在定价和综合成本上均有显著下调。其 API 定价为每百万输入 token 4 美元、每百万输出 token 20 美元,输入输出价格较 Opus 5 降低 20%;缓存命中价格为 0.20 美元/百万 token,较前代下降 60%[S2][S4][S7][S9][S12]。综合来看,典型任务的整体运行成本比 Opus 5 低约 40%,这一降幅既来自单价下调,也得益于模型在长任务中更少的重试与更高效的推理路径[S1][S2][S4][S7][S8][S12]。

速度方面,普通模式下 Opus 5.5 的输出生成速度比 Opus 5 快 30% 以上[S1][S2][S7][S8][S12]。另有信息显示,Claude Code 和 Claude Platform 还提供最高 2.5 倍速度的 Fast mode,对应输入、输出价格分别为每百万 token 8 美元和 40 美元,但该模式的适用平台、开通条件和实际可用性仍需以官方后续细则为准[S7]。

API 与协作体验调整 Opus 5.5 在 API 层面引入了两项重要变化,可能影响既有集成方案。其一,思考模式改为始终自适应,禁用思考或设置固定思考预算的请求会被拒绝,模型会根据任务复杂度自行决定思考深度,开发者需通过 effort 参数和提示词来引导思考行为[S8]。其二,强制工具调用功能被取消,无法要求模型必须调用工具或指定具体工具,官方建议改为通过提示引导模型使用工具,并在调用失败时由上层框架进行重试[S8]。

协作体验上,Opus 5.5 被设计为更适合长任务协作的伙伴,能够用更清晰的自然语言汇报已完成的工作、发现的问题以及下一步需要的信息,便于人类监督多步骤、长时间运行的智能体任务[S8][S11]。早期测试案例显示,在 20 万行代码库审计任务中,Opus 5.5 用时不到 3 小时,而 Opus 5 完成同类任务超过 20 小时,token 消耗约为前者的 2.5 倍[S2][S3][S11]。

上线渠道与生态覆盖 发布当日,Claude Opus 5.5 已在 Vercel AI Gateway 和 AWS Amazon Bedrock 上线,同时可通过亚马逊云科技、谷歌云、微软 Azure 三大云平台获取,面向开发者与企业用户开放使用[S1][S8][S9][S12]。这意味着企业客户无需更换既有云供应商体系,即可快速接入新模型进行测试与部署。

安全方面,Opus 5.5 在发布前经过了 Frontier Design 和 METR 等独立 AI 安全研究机构的外部测试,并内置了此前仅用于最高能力系统的安全防护机制,在自动化行为审计、抵抗提示注入和长任务对齐测试中表现更强[S2][S12]。

后续规划与竞争格局 Anthropic 计划在未来几周内推出 Claude Sonnet 5.5 和 Claude Haiku 5.5 两款模型,进一步完善 5.5 家族的产品矩阵,分别覆盖均衡性能与高速低成本场景[S2][S4][S6][S9][S11]。目前这两款模型的具体性能、定价和精确上线时间尚未公布。

从市场竞争看,Opus 5.5 发布前后,OpenAI 推出了 GPT-6 Sol 和 Luna 两款新模型并大幅降价,xAI 旗下 SpaceXAI 也发布了 Grok 4.7 旗舰模型,前沿大模型市场正进入“性能与成本双重比拼”的密集发布期。对开发者和企业而言,短期内可选的前沿模型更多、单位成本更低,但也需要在不同厂商的能力侧重、API 兼容性与生态服务之间做更细致的权衡。

参考资料 [S1] Anthropic 官方发布页:https://www.anthropic.com/claude-opus-5-5 [S2] 搜狐财经:Anthropic发布Claude Opus 5.5:成本低40%性能媲美Fable 5.1,https://m.sohu.com/a/1079712953_122066678/ [S3] 新浪财经:Claude Opus 5.5 发布:一天内迁移 68 万行代码,http://finance.sina.cn/2026-09-23/detail-inistvut5511911.d.html [S4] C114通信网:Claude Opus 5.5 发布:多数任务追平 Fable 5.1,典型成本降 40%,https://www.c114.net.cn/ainews [S5] 搜狐财经:Anthropic发布Claude Opus 5.5,性能接近Fable且价格降低,https://m.sohu.com/a/1079707211_122066678/ [S6] 新浪科技:Claude Opus 5.5 来了!性能追平 Fable,成本暴降 40%,https://finance.sina.com.cn/tech/roll/2026-09-23/doc-inisuaar5397692.shtml [S7] 网易科技:Claude Opus 5.5 发布:强如 Fable,价格更低,http://m.163.com/dy/article/L7FN8DFR0556C3J2.html [S8] Vercel 官方更新日志:Claude Opus 5.5 now available on AI Gateway,https://vercel.com/changelog/claude-opus-5-5-now-available-on-ai-gateway [S9] 新浪财经:Anthropic:未来几周将推出Claude Sonnet 5.5与Claude Haiku 5.5,http://finance.sina.cn/2026-09-23/detail-inistrnx1808447.d.html [S10] TechnoSports:Claude Opus 5.5 Launches as Anthropic’s Paced Frontier Model,https://technosports.co.in/claude-opus-launch-details/?amp=1 [S11] 网易AppSo:最卷一夜! Claude 5.5 发布,性能直逼 Fable,还要卷价格,http://m.163.com/dy/article/L7FVNDC90511CSAO.html [S12] Fidelity/Reuters:Anthropic unveils Claude Opus 5.5,https://www.fidelity.com/news/article/company-news/202609221233RTRSNEWSCOMBINED_KBN3V81UY-OUSBS_1

Editorial dossier

制作记录

公开编辑轨迹,不含隐藏推理。

制作记录已完成审读
材料已核验公开资料经过整理
多方来源互证保留可追溯引用
文字完成审读编辑意见已被处理
制作记录文章已进入公开阅读

正在整理制作记录…

Reader Signal

这篇文章对你有帮助吗?

只收集预设选项,不开放评论,不公开展示个人反馈。

选择一个判断,也可以附加一个预设标签。

发布于 2026-09-23 07:06:30。本文由明确标注的 Aione AI 编辑 Agent 参与制作,未经授权不得转载,不构成投资建议。