Copied


NVIDIA Groq 3 LPX 全面投产,加速 AI 推理速度

realtime news   Aug 24, 2026 16:43 1 Min Read


NVIDIA 今日宣布,其 Groq 3 LPX AI 推理加速器已进入全面生产,这标志着低延迟 AI 系统演进中的一个重要里程碑。集成到 NVIDIA Vera Rubin 平台中的 Groq 3 LPX 旨在满足 agentic AI 应用中对超快 token 生成日益增长的需求。基准测试结果显示,其创纪录的速度达到每秒 3,400 个 token,比最接近的竞争平台快四倍。

依赖实时推理来执行复杂任务的 agentic AI 系统已成为 NVIDIA 的关键关注点。Groq 3 LPX 专为处理延迟敏感的工作负载而设计,通过确定性执行和大规模片上 SRAM 来消除瓶颈。这使其成为 NVIDIA AI 工厂架构中的关键角色,该架构还包括用于更广泛训练和推理工作负载的 Vera Rubin NVL72 系统。

NVIDIA 的 CEO 黄仁勋强调了推理在 AI 开发中的重要性:“推理是 AI 的增长引擎。Groq 3 LPX 推动了性能的前沿突破,提供超快的 token 生成速度,正值全球对实时 AI 计算需求加速增长之际。”

AI 云平台 Nebius 是 Groq 3 LPX 的首批采用者。该公司计划将加速器部署于其 Nebius Token Factory,使开发者无需更改 API 即可利用极限的 token 生成能力。在 Nebius 之后,Groq 自身的 AI 推理云有望采用该平台,这表明行业对该技术的广泛兴趣。

从技术角度来看,Groq 3 LPX 带来了显著的进步。其机架级系统包括 256 个 Groq 3 LP30 芯片,提供 315 PFLOPS 的 FP8 计算能力以及惊人的 40 PB/s 片上 SRAM 带宽。这些规格使该平台能够高效处理大上下文的 AI 模型,这是 agentic 系统实时生成数十万 token 的必要条件。

在市场方面,NVIDIA 的股票目前交易价格为 210.39 美元,今天的公告后下跌了 2.02%。该公司的市值为 5.13 万亿美元。虽然股票的下跌与整体市场波动一致,但 Groq 3 LPX 的推出可能成为长期的催化剂,特别是在企业对高性能 AI 推理解决方案的需求扩大的情况下。

这一生产里程碑也反映了 NVIDIA 的战略转型。今年早些时候,该公司从路线图中移除了 Rubin CPX 加速器,转而专注于以 Groq 3 LPX 为核心的 AI 推理战略。这一举措突显了 NVIDIA 致力于主导 AI 市场延迟敏感领域的承诺,在这一领域中,token 生成速度对于编码、实时决策和多代理系统等应用至关重要。

随着 AI 市场预计呈指数级增长,NVIDIA 的 Groq 3 LPX 旨在捕捉企业对专用推理解决方案的需求。该平台整合到现有和新兴的 AI 基础架构中,可能进一步巩固 NVIDIA 在 AI 加速领域的领导地位。


Read More