返回热力追踪
关键AI产品
OpenAI推出Ultrafast超快模式,GPT-5.6 Sol速度最高提升14倍
OpenAI官方预览GPT-5.6 Sol的全新Ultrafast服务层级,由Cerebras提供算力支持,运行速度最高可达标准模式的14倍,每秒输出最高750 tokens。该模式率先在OpenAI API向首批客户开放预览,瞄准低延迟高要求场景。
编辑视角
头部厂商大模型速度竞赛加速,超快速度模式解锁低延迟场景新需求,对AI产品落地、推理算力格局都有重要影响,值得从业者关注。
深度解读
本次OpenAI发布的是GPT-5.6 Sol的全新Ultrafast服务层级,并非发布新模型,该模式依托Cerebras硬件实现14倍速度提升,最高输出750 tokens/秒,定位高延迟敏感的生产场景,目前仅向首批API客户开放预览,后续将逐步扩大访问范围。官方明确该方向是在不损失模型能力的前提下提升推理速度,已经列举了编码、金融、电商、客服等多个潜在应用场景。需要明确边界:目前公开演示未披露具体测试环境、全场景完整指标,无法证实所有任务都能稳定达到14倍速度提升,也未公布该服务层级的具体定价信息。后续需要追踪该服务的定价策略、大规模开放后的实际表现,以及对行业推理速度竞争的带动作用。
核心要点
- OpenAI推出GPT-5.6 Sol的Ultrafast超快服务层级
- 由Cerebras提供算力,速度最高可达标准模式的14倍
- 支持最高750 tokens/秒输出,瞄准低延迟敏感场景
- 目前仅对首批API客户开放预览,后续逐步扩容开放
延伸阅读
- 以 GPT‑5.6 推进性价比前沿 — OpenAI官方对GPT-5.6系列的定价与效率说明