英伟达宣布:完成200亿美元收购后 Groq服务器机架将于今年投入使用

文/hodor 2026-08-25 16:30:34 591

【友财网讯】-英伟达周一宣布,Groq 3 LPX服务器机架已实现全面量产,标志着这家公司史上最大一笔收购所获得的技术正式走向商业化。


英伟达宣布:完成200亿美元收购后 Groq服务器机架将于今年投入使用


英伟达高级总监迪翁·哈里斯向记者表示,这批Groq机架将与Vera中央处理器、Rubin图形处理器一同部署于Nebius新云数据中心,并将于今年晚些时候正式上线。


英伟达加紧量产Groq芯片并推向客户,凸显出低延迟推理的重要性日益提升。低延迟推理能够让AI智能体给用户带来即时响应,避免长时间等待,在代码生成场景下尤为关键。英伟达表示,云服务商可以为此类算力Token收取更高费用。


哈里斯称:“对于提供算力Token服务的厂商而言,这使其能够面向对延迟高度敏感的用户与客户,推出高端分级服务。”


去年12月,英伟达斥资200亿美元收购芯片初创企业Groq的相关资产,这是该公司有史以来规模最大的一笔收购。


Groq芯片架构在芯片裸片上集成500MB高速静态随机存储器(SRAM),以此缓解内存带来的性能瓶颈。Groq芯片由三星代工生产,而英伟达的GPU则由台积电制造。


英伟达将256颗独立的Groq‑3芯片封装进LPX机架。英伟达援引人工智能分析机构Artificial Analysis的基准测试数据称,Groq 3 LPX机架每秒可输出3400个Token。


该赛道竞争激烈。中小型GPU厂商超威(AMD)今年早些时候宣布,将把机架级系统与近期上市的Cerebras芯片相结合,同样主打低延迟推理。OpenAI新推出的极速模式目前每秒可输出750个Token,该模式正是由Cerebras芯片提供算力支持。


低延迟芯片并不会取代作为AI算力主力的GPU。GPU既可以完成训练任务,也能够执行推理,灵活性强,可以适配新技术与新模型。Groq这类低延迟芯片主要聚焦模型服务流程中的解码阶段。


哈里斯表示:“这并不是要取代GPU,而是针对不同的业务负载,选用适配的处理器,兼顾成本与性能。”


英伟达目前正在加大Vera Rubin系统的出货量,该系统于今年启动生产。在3月份Vera Rubin与Groq 3 LPX的发布会上,英伟达首席执行官黄仁勋预测,到2027年,当前一代Blackwell芯片与全新Vera Rubin系统的累计销售额将达到1万亿美元。


黄仁勋当时表示,会将用于代码类应用的数据中心四分之一的机柜空间分配给Groq芯片。


他说:“数据中心其余机柜则全部部署Vera Rubin。”


英伟达将于周三公布财报。