
英伟达高管最新宣布,Groq 3 LPX机架已进入全面量产阶段,这标志着该公司史上最大规模收购案所获得的技术正式实现商业化。
当地时间周一(8月24日),英伟达高级总监Dion Harris表示,Groq机架将与Vera中央处理器和Rubin图形处理器一同部署在新型云服务商Nebius的数据中心,并将于今年晚些时候上线。
英伟达加速生产Groq芯片并向客户提供产品,凸显出低延迟推理的重要性日益提升。低延迟推理能够让AI智能体更快响应,避免用户长时间等待,在编程等应用中尤其重要。
正配配资Harris说道,云服务商可以针对这类token(词元)收取更高费用,“对于那些提供token服务的企业而言,这让他们能够为那些对延迟极其敏感的用户和客户提供高级服务套餐。”
去年12月,英伟达与Groq达成200亿美元交易,获得了Groq的芯片技术授权,多位核心员工也加入了英伟达,创始人Jonathan Ross更是担任了英伟达首席软件架构师。
今年3月,英伟达发布了为Vera Rubin平台研发的推理加速器Groq 3 LPX。Groq架构在芯片裸片上集成了500兆字节的高速静态随机存储器(SRAM),以减少与内存相关的瓶颈。
据了解,Groq芯片由三星制造,而英伟达的GPU则由台积电生产。每一个LPX机架可整合256颗Groq 3,英伟达援引Artificial Analysis的基准测试称,整合后的机架每秒可处理3400个token。

当下, 这一领域竞争激烈。AMD今年早些时候宣布,将把其机架级系统与Cerebras的芯片进行整合。Cerebras近期刚刚上市,业务重点同样是低延迟推理。

近期,OpenAI推出的“Ultrafast”模式承诺每秒可处理750个token,由Cerebras提供支持。
需要指出的是,低延迟芯片并不能取代作为AI芯片主力的GPU。GPU既能够执行训练,也能够进行推理,同时具备足够的灵活性,可以适应新技术和新模型。
Groq这类低延迟芯片则主要专注于模型服务中的一个环节,即“解码”(decode)阶段。Harris也提到:“这并不是要取代GPU,而是要针对工作负载的不同环节,使用价格合适、处理能力合适的处理器。”
英伟达目前正在加快Vera Rubin系统的出货速度。黄仁勋先前曾预计,到2027年,当前一代Blackwell芯片和新一代Vera Rubin系统的累计销售额将达到1万亿美元。
黄仁勋当时表示分红到账时间,他计划将面向编程应用的数据中心空间中约四分之一分配给Groq芯片。“我的数据中心其余部分将100%采用Vera Rubin。”

围绕以事件驱动为主的震荡期的交易阶段,多次经历轮回的老股民群近期,在区域性证券市场的风格轮廓尚未清晰阶段中,围绕“挂牌配
2026-08-25
9月6日金融一线消息,中国再保今日发布公告称,董事会审议通过并披露向特定对象发行内资股方案。本次发行拟由财政部以现金方式
2026-09-06
海报新闻记者 孙佃潇 报道 近日,国家金融监督管理总局湖北监管局、孝感监管分局、宜昌监管分局同步公示行政处罚信息,共处罚
2026-08-18
《科幻世界》亮相深圳文博会 封面新闻记者张杰 对于中国科幻迷而言,成都市人民南路四段11号是个特别梦幻的地方。1999年
2026-08-10
证券配资服务平台 你今天喝的那杯咖啡,可能正变得史无前例地昂贵! 近一个半月,咖啡期货价格暴涨近40%。不只是咖啡,全球
2026-08-18