Nvidia 宣布其专为 AI 智能体推理加速设计的 Groq 3 LPX 芯片进入全面生产阶段,并宣称在独立基准测试中,其系统以每秒 3400 个 token 的速度比 Cerebras 芯片快四倍。然而,专家指出这一对比存在偏差:Nvidia 达到该成绩需依赖至少 64 颗芯片组成的机架系统,而 Cerebras 仅需一至两颗加速器即可实现。Groq 3 LPX 采用 SRAM 密集型数据流架构,单芯片内存仅 500 MB,远小于 Rubin GPU 的 288 GB,因此模型需通过以太网分散至多个芯片协同工作。该芯片旨在加速智能体应用中的 token 生成,从而在可接受的等待时间内支持更多推理步骤和工具调用,将编码任务从数小时缩短至数分钟。其实际性能优势在复杂部署场景中可能受限。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅