OpenAI 发布了首款自研推理芯片 Jalapeño,其首批实测性能数据在多个基准上超越英伟达 GB200/GB300 等顶级商用系统。在 GPT-OSS 120B、DeepSeek R1 和 Kimi K2.5 等模型测试中,该芯片每瓦峰值吞吐量是对照系统的 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍,高交互负载性能提升最高达 4.1 倍。Jalapeño 采用台积电 N3P 工艺,功耗仅 700W,通过极简内存层级设计减少数据搬运,实现了高吞吐与低延迟的兼得。尽管测试条件由 OpenAI 自定,且尚未通过长上下文 AgentX 测试,但行业共识认为,第一代自研芯片即达到如此竞争力尚无先例。该芯片为通用推理引擎,非 OpenAI 模型独占,其高能效比有望降低大规模推理服务的成本,进而可能影响 ChatGPT 的定价策略。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅