返回热力追踪
关键AI产品芯片
NVIDIA推出Groq 3 LPX推理加速器 Vera Rubin平台进入量产阶段
NVIDIA正式推出专为Agentic AI设计的Groq 3 LPX交互式AI推理加速器,该产品适配NVIDIA Vera Rubin平台,核心部件为Vera Rubin NVL72。官方称该平台相比GB300 NVL72实现性能与成本大幅优化,目前Groq 3 LPX已进入正式量产阶段。
编辑视角
这是NVIDIA针对Agentic AI长上下文交互场景推出的专用加速产品,性能和成本优势显著,将直接影响推理基础设施的选型与Agentic AI落地成本,是AI硬件领域的重要新品发布。
深度解读
主旨:NVIDIA发布面向代理式AI的Groq 3 LPX推理加速器,配套Vera Rubin平台正式量产,主打长上下文超快速交互,旨在提升AI代理任务的效率,降低推理成本。证据:官方多语言站点均确认Groq 3 LPX进入量产,公开了性能对比数据,Vera Rubin NVL72相比GB300 NVL72性能提升30倍、token成本降低至1/35,SpaceXAI已宣布采用相关方案扩展AI基础设施。边界:当前公开信息仅披露了性能对比数据与量产计划,未公开具体的客户订单规模、实际部署案例细节,也未放出完整技术规格参数,现有对比仅针对GB300 NVL72,缺少与其他同类推理加速产品的横向对比数据。后续观察点:该产品的实际落地部署表现、客户 adoption 情况、对现有推理加速市场的价格影响。
核心要点
- Groq 3 LPX是面向Agentic AI的交互式推理加速器,已正式量产
- 该加速器适配NVIDIA Vera Rubin平台,核心为Vera Rubin NVL72
- Vera Rubin NVL72对比GB300 NVL72性能提30倍,token成本降35倍
- SpaceXAI已采用NVIDIA Vera CPU,计划扩展Vera Rubin AI基础设施
延伸阅读
- Serve Qwen3.8-2.4T-A95B, a 2.4T-Parameter Model, with Configurable Reasoning on NVIDIA GB300 NVL72 — 可对比新旧平台参数,了解NVIDIA技术迭代路线