动察 Beating AI 快讯,英伟达 Groq 3 LPX 已进入全面量产。去年 12 月,英伟达花约 200 亿美元拿下 Groq 技术授权,并挖走创始人 Jonathan Ross 等核心团队。8 个月后,这笔交易的第一款硬件正式落地。 Groq 3 LPX 是一套专门加速大模型推理的系统,里面用了 256 颗 Groq 3 LPU 芯片。在 Artificial Analysis 测试中,Gemma 4 31B 输入 10 万 Token 后,Groq 3 LPX 跑到每秒 3431 个输出 Token。同一测试下,当时市面上可公开调用的最快 API 只有约 870 个,Groq 3 LPX 接近 4 倍。 实际部署时,Rubin GPU 负责更重的计算,Groq 3 LPX 专门提高 Token 生成速度。对 Coding Agent 来说,连续几十、几百次调用模型时,可以明显减少等模型「吐字」的时间。 Nebius 将成为首家采用 Groq 3 LPX 的 AI 云厂商。更有意思的是,Groq 自己也成了首批采用者之一,还会与 Dell 一起部署。去年把技术授权给英伟达,今年又开始用英伟达做出来的「Groq」。
查看原文 >