Anthropic发布Claude Haiku 5.5价格降九成且性能大幅提升
Anthropic发布Claude Haiku 5.5,10万token内单价较上代降九成、平均成本降约75%,多项性能指标翻倍提升,将推动小模型场景规模化落地。
发布背景与基本信息
美国当地时间2026年10月7日,Anthropic正式推出Claude Haiku 5.5小型大模型,这是Claude 5.5家族中继Opus 5.5、Sonnet 5.5之后的第三款产品,也标志着该系列从高端推理到低成本调用的完整产品矩阵正式形成S1。官方将其定位为“迄今最便宜、最快、能力最强的小型模型”,主要面向高吞吐、成本敏感型任务场景设计,同时具备作为高端模型子智能体的协同能力S1。
在此之前,Anthropic已于2026年9月22日发布旗舰模型Claude Opus 5.5,9月28日发布中端模型Claude Sonnet 5.5,两款产品均以“性能持平前代高端、成本显著下降”为核心卖点,而Haiku 5.5的发布则进一步将成本下探到小型模型赛道的主流价格带,形成覆盖不同算力需求的完整产品线S1。
价格体系与成本变化
Haiku 5.5采用按提示词长度分档的定价机制,其中10万token以内的请求享受最低价格:输入每百万token 0.10美元,输出每百万token 0.50美元,缓存读取仅0.01美元,缓存写入0.125美元S1。与上代Haiku 4.5相比,这一价格区间的单价降幅达到90%,相当于直接打一折S1。
对于超过10万token的长上下文请求,Haiku 5.5价格调整为输入每百万0.50美元、输出每百万2.50美元,缓存读取0.05美元,缓存写入0.625美元,较上代仍有50%的降幅S1。官方数据显示,约90%的Haiku历史请求集中在10万token以内,因此绝大多数用户实际可享受到九成降价的优惠S1。
需要注意的是,由于Haiku 5.5更换了与Opus 5.5相同的新版分词器,相同文本对应的token数量会比Haiku 4.5增加约30%,综合计算下来,平均运行成本较上代降低约75%,而非单纯的单价降幅S1。此外,该模型还支持批处理API再享五折优惠,进一步降低大规模调用的成本S2。
同期配套调整的还有Sonnet 5.5的缓存读取价格,从每百万token 0.20美元减半至0.10美元。由于缓存读取在智能体任务的token消耗中占比较高,官方估算这一调整可使Sonnet 5.5执行多数智能体任务的整体成本下降约20%S1。Anthropic还同步推出订阅用户API积分政策,Max 5x用户每月获100美元额度,Max 20x用户每月200美元,Team订阅用户最高500美元团队共享额度,相当于订阅费全额返还为API调用金S2。
性能指标提升情况
与价格大幅下降形成对比的是,Haiku 5.5在多项核心基准测试中实现了性能翻倍甚至数倍的提升。在知识工作领域,GDPval-AA v2.1测试得分从Haiku 4.5的735分跃升至1620分,AA-Briefcase v1.1测试达到1578分,均超过OpenAI同期发布的GPT-6 LunaS1。
电脑操作能力的提升尤为显著,OSWorld 2.1离线子集准确率从15.7%飙升至72.4%,意味着模型已具备较为成熟的跨应用操作、多步骤任务执行能力,能够支撑浏览器自动化、办公流程辅助等场景S1。编程能力方面,Terminal-Bench 4.0测试得分从0%提升至39.2%,FrontierCode 1.1(Main)达到46.4%,补上了上代小型模型在代码智能体领域的短板S1。
多学科推理测试Humanity’s Last Exam(无工具模式)准确率从10.2%提升至45.9%,视觉推理Chartography测试从6.4%提升至46.4%,显示模型在复杂逻辑理解和图表信息提取方面的能力也有明显进步S1。
企业早期测试数据也验证了性能提升的实际效果。协作工具厂商Asana表示,在bug分类、项目搭建等任务中,Haiku 5.5使任务完成延迟降低30%以上,单轮推理速度最高提升2.5倍S1。企业内容管理平台Box测试显示,新模型得分比Haiku 4.5高11分,延迟仅为后者的一半,可支撑大规模分析类工作负载S1。智能搜索公司AlphaSense在400次文档查询测试中,测得Haiku 5.5准确率从0.76提升至0.84,且具有统计显著性S1。
可调档位与产品定位
Haiku 5.5是Haiku系列中首款支持可调effort(推理强度)档位的模型,共提供Low、Med、High、Xhigh、Max五档选择,API默认采用Med档位S1。用户可根据任务复杂度和成本预算灵活调整:低档位适合简单分类、摘要等标准化任务,进一步压缩成本;高档位则可应对更复杂的推理需求,在小型模型范畴内追求更高准确率S1。
官方明确了Haiku 5.5与同系列其他模型的分工边界:复杂的智能体编码、多步骤深度推理仍建议使用Sonnet 5.5或Opus 5.5,而Haiku 5.5的核心定位是处理高吞吐、边界清晰的轻量任务,包括文本摘要、上下文压缩、数据库查询、内容分类、实时客服、浏览器操作等S1。
另一个重要定位是作为高端模型的“子智能体”参与协同工作。官方演示显示,在一个鸡蛋防护装置设计任务中,单独使用Opus 5.5完成任务耗时3分37秒、测试25种方案、花费0.47美元;而由Opus 5.5统筹、搭配10个Haiku 5.5子智能体并行执行,仅需58秒、测试86种方案、花费0.14美元,实现了速度更快、成本更低、方案更多的效果S2。这种“大模型拆任务、小模型跑执行”的分层架构,正在成为智能体应用的主流成本优化路径。
上线平台与迁移注意事项
目前Haiku 5.5已实现全平台上线,覆盖Claude官方平台、Claude Code、AWS Amazon Bedrock、Google Cloud Vertex AI、Microsoft Azure等主流渠道,开发者可通过模型ID claude-haiku-5-5 直接调用S1。官方同时提供了迁移指南,帮助原有Haiku 4.5用户平滑升级。
需要开发者注意的是,Haiku 5.5存在多处不兼容变更:不再支持固定思考预算参数budget_tokens,需改用自适应思考加档位设置;temperature、top_p、top_k等采样参数被移除,其中top_k和非默认值的temperature、top_p会直接返回400错误;不再支持预填助手回复(prefill)功能,需改用结构化输出接口;电脑操作工具需从旧版computer_20250124升级为computer_toolset_20260801;且暂不支持Priority Tier服务等级S7。
此外,由于默认开启自适应思考,模型回复可能以思考块开头,原有按位置取回复内容的代码需改为按内容类型提取,避免误读思考过程文本S7。对于使用Claude Managed Agents的用户,只需更换模型ID即可完成升级,无需额外调整代码逻辑S7。
行业影响与竞争格局
Haiku 5.5的发布将小型大模型的竞争从“低价低能”推向“低价高能”的新阶段。在此之前,OpenAI GPT-6 Luna凭借0.10美元/百万输入token的价格和不错的性能,在小模型赛道占据优势,而Anthropic此次直接将价格拉平,且在知识工作、电脑操作等多项指标上实现反超,标志着头部厂商在小型模型赛道的正面竞争全面展开S6。
从全球范围看,小模型价格战仍在持续升级。中国厂商的开源及商用小模型已打出更低价格,例如Qwen3.7 Flash在短上下文场景的价格低于Haiku 5.5,GLM-5.3-Flash在部分知识工作测试中得分甚至略高S6。这意味着Anthropic的降价既是应对OpenAI的直接竞争,也是应对来自开源模型和其他厂商的成本压力,反映出大模型行业正从单纯追求性能峰值,转向性能、成本、速度的综合平衡竞争S6。
对于开发者和企业用户而言,小型模型能力的快速提升和价格的大幅下降,将显著降低AI规模化落地的门槛。以往因成本限制难以大规模部署的场景,如全量文档摘要、实时内容审核、大规模数据分类、智能体子任务分发等,现在具备了经济可行性。而可调档位设计和分层智能体架构,也为不同需求的用户提供了更精细的成本优化空间,推动AI应用从“尝鲜式部署”向“全流程渗透”演进。
参考资料: S1 Anthropic官方发布页面. Introducing Claude Haiku 5.5. https://www.anthropic.com/claude-haiku-5-5 S2 凤凰网科技. Claude Haiku 5.5发布:单价降九成. https://tech.ifeng.com/c/8x2zsJwwhS7 S6 腾讯新闻. “价格打骨折”,Claude Haiku 5.5把小模型卷到一分钱时代. https://news.qq.com/rain/a/20261008A02IM900 S7 AI Wain Blog. Anthropic Releases Claude Haiku 5.5 - One-Tenth of Haiku 4.5's Rates for Prompts Up to 100K Tokens, and Sonnet 5.5 Cache Reads Cut in Half. https://ai.wain.blog/en/anthropic-claude-haiku-5-5-Wl-OX6Kf/
参考资料
- [S1] Introducing Claude Haiku 5.5 \ Anthropicanthropic.com
- [S2] Claude Haiku 5.5发布:单价降九成_凤凰网tech.ifeng.com
- [S3] Anthropic发布最新AI模型Claude Haiku 5.5,运行成本较4.5低约75%tmtpost.com
- [S4] Claude 新模型成本降 75%,小型模型也能兼顾速度与性能|anthropic|claude haiku 5.5_新浪新闻sina.cn
- [S5] Anthropic发布Claude Haiku 5.5:成本直降75%,性能大幅提升_价格_读取_支持sohu.com
- [S10] Anthropic 发布 Claude Haiku 5.5:成本直降 75%,5.5 系列正式集结_模型_推理_任务m.sohu.com
- [S11] Anthropic推出Claude Haiku 5.5,API价格大幅降低_推理_成本_OSWorldsohu.com
- [S6] “价格打骨折”,Claude Haiku 5.5把小模型卷到一分钱时代_腾讯新闻news.qq.com
- [S7] Anthropic Releases Claude Haiku 5.5 - One-Tenth of Haiku 4.5's Rates for Prompts Up to 100K Tokens, and Sonnet 5.5 Cache Reads Cut in Halfai.wain.blog
- [S8] Anthropic推出Claude Haiku 5.5,运行成本大幅下降75%_模型_tokens_Sonnetsohu.com
- [S9] Anthropic推出Claude Haiku 5.5:成本下降75%,性能大幅提升_token_模型_人工智能m.sohu.com
制作记录
公开编辑轨迹,不含隐藏推理。
正在整理制作记录…
Reader Signal
这篇文章对你有帮助吗?
只收集预设选项,不开放评论,不公开展示个人反馈。
选择一个判断,也可以附加一个预设标签。
发布于 2026-10-09 07:02:46。本文由明确标注的 Aione AI 编辑 Agent 参与制作,未经授权不得转载,不构成投资建议。