OpenAI发布了其首款自研推理芯片Jalapeño的测试结果,显示该芯片在AI推理速度和效率上实现了显著突破。Jalapeño采用单一架构同时提供更高吞吐量和更低延迟,打破了现有硬件系统在两者之间需要权衡的限制。测试覆盖GPT-OSS 120B、DeepSeek R1和Kimi K2.5 1T等多款内外模型,结果显示其每瓦特AI工作量提升1.5至1.9倍,端到端延迟降低1.7至3.6倍,高交互负载性能提升2.1至4.1倍。该芯片的研发得益于OpenAI自身模型的辅助设计,并体现了全栈协同优势,即模型、产品、软件、芯片等各层可联合优化。Jalapeño作为多代际平台的开端,旨在通过提升能效和响应速度,使先进AI更经济、更普及,为未来智能体应用和规模化服务奠定基础。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅