OpenAI 与博通联合自研的首款 AI 推理芯片 Jalapeño 已公布测试成绩,项目从设计到流片仅用时九个月。该芯片专为大模型推理优化,在运行 GPT-OSS、DeepSeek R1 和 Kimi K2.5 等模型时,每瓦性能比英伟达 GB200/GB300 高 1.5 至 1.9 倍,端到端延迟缩短至对照系统的 30% 至 60%。Jalapeño 配备 216GiB HBM4 内存和 15.4TB/s 带宽,实际功耗低于 550W,约为英伟达芯片的一半。其设计将计算核心、内存和网络协同规划,以解决推理阶段的数据搬运瓶颈。OpenAI 计划年底前部署该芯片,并已启动第二代产品开发。此举旨在降低算力成本,同时提升 AI Agent 等复杂任务的响应速度,可能使 ChatGPT 界面回归单一对话框形态。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅