欢迎访问深圳市中小企业公共服务平台电子信息窗口

英伟达200亿美元赌局兑现:Groq 3 LPX量产,推理速度碾压竞品4倍

2026-08-26 来源:电子工程专辑
54

关键词: 英伟达 Groq 3 LPX 量产 智能体AI 推理加速

近日,AI芯片龙头英伟达宣布,旗下Groq 3 LPX架构已实现全面量产。这标志着英伟达公司史上最大规模收购——去年12月以200亿美元拿下芯片初创公司Groq核心班底——正式完成商业化落地。

据英伟达介绍,Groq 3 LPX在独立评测中展现出“世界级的速度”,其响应速度比表现最接近的替代平台还要快4倍,专为智能体AI(Agentic AI)时代的低延迟推理需求而生。

收购成果商业化:从200亿美元到量产机架

Groq 3 LPX的量产,是英伟达整合Groq技术后的首个重大商业化成果。去年12月,英伟达以200亿美元完成对Groq核心团队的收购,创下公司史上最大单笔交易纪录。今年3月,英伟达宣布推出基于Groq技术的定制芯片Groq 3 LPU,并预告装载该芯片的数据中心机架LPX将于第三季度出货。如今,这一时间表如期兑现。

英伟达CEO黄仁勋在声明中表示:“Vera Rubin延续了我们的愿景,推出了针对智能体AI时代设计的‘工作负载优化型AI工厂配置’,通过LPX实现超高速Token生成,再度突破性能上限。正如全球对AI计算的需求正在加速增长一样,这改变了智能的生产方式,使AI吞吐量、效率和响应速度实现了又一次巨大飞跃。”

据英伟达介绍,智能体AI带来了两个独特的计算挑战:一是对海量上下文的高效处理,二是以极低延迟生成Token。Groq 3 LPX专为拓展Vera Rubin NVL72系统的交互性而生——即针对单个用户生成Token的速率,这直接决定了智能体完成其工作中每一步的速度。

性能实测:响应速度快4倍,解锁新商业模式

在全球知名独立AI大模型评测机构Artificial Analysis的基准测试中,Groq 3 LPX在智能体编程及其他对延迟敏感的工作负载中展现出“世界级的速度”,其响应速度比表现最接近的替代平台还要快4倍。

英伟达高级总监狄翁·哈里斯(Dion Harris)在接受外媒采访时表示,云服务厂商可以针对这种高质量的Token输出收取更高的费用:“他们能够解锁新的商业模式,为那些对延迟极其敏感、且对此有严格服务协议(SLA)需求的最终用户和客户,提供更高溢价的高级服务套餐。”

这一表态揭示了英伟达的产品战略:像Groq这样的低延迟芯片并不会取代GPU,而是专注于模型服务中被称为“解码”阶段的部分,与英伟达的主力GPU产品线形成互补。今年5月,黄仁勋曾在财报电话会上表示,该机架“为低延迟和高token生成速度而设计的,但其吞吐量很低”,用例并不广泛。然而,随着智能体AI的兴起,低延迟推理的重要性正迅速上升。

首个客户落地:Nebius率先采用

在商业化落地方面,新云厂商Nebius成为首个采用英伟达Groq 3 LPX的AI云服务商,相关产品将于今年晚些时候正式上线。Nebius的率先入局,为Groq 3 LPX的市场接受度提供了初步验证。

英伟达正在努力制造Groq芯片并向客户交付,凸显出低延迟推理在AI产业格局中日增长的战略地位。随着AI应用从简单的问答聊天向复杂的多步骤智能体工作流演进,模型需要在短时间内连续生成大量Token并作出决策,这对推理延迟提出了前所未有的苛刻要求。

尽管Groq 3 LPX量产传来利好,英伟达在资本市场的表现却持续承压。8月24日当天,英伟达(Nasdaq:NVDA)股价下跌2.91%,收于每股208.48美元,总市值5.05万亿美元。值得注意的是,公司股价已连续第七个交易日收跌,创下2022年以来的最长连跌纪录。

市场普遍将这波下跌归因于投资者对AI芯片需求增速放缓的担忧,以及英伟达即将于当地时间8月26日美股盘后发布的季度财报。在财报发布前,市场对英伟达数据中心业务收入增速、毛利率走势以及未来指引高度敏感。Groq 3 LPX的量产能否为财报电话会增添亮色,成为投资者关注的焦点。

此外,据外媒近日报道,英伟达最大的几家客户已被告知,搭载其AI芯片的服务器价格将上涨超过15%,从明年初出货的系统正式生效。此次涨价将影响包括搭载旗舰级Vera Rubin和Grace Blackwell芯片在内的服务器系统。