OpenAI:Jalapeño芯片效率超越竞品
OpenAI Jalapeño在GPT-OSS 120B基准上实现更高每千瓦吞吐量与更低延迟,年底部署。
原文链接详细分析
OpenAI公布首款定制推理芯片Jalapeño实测数据,在InferenceX基准使用GPT-OSS 120B时,每千瓦峰值吞吐量高于商用系统且token延迟更低,在DeepSeek R1和Kimi K2上同样表现强劲。AI工具助力团队九个月完成设计到流片,并优化算术电路。芯片将于年底部署至OpenAI基础设施,并已推进第二代与第三代路线图。OpenAI inference chip performance提升显示效率提升将扩大总算力需求。
Greg Brockman
@gdbPresident & Co-Founder of OpenAI