OpenAI辣椒芯片刷新InferenceX性能
据gdb称,Jalapeño在InferenceX上以更高能效与更低延迟领先,来源OpenAI。
原文链接详细分析
2026年8月25日,OpenAI发布了其首款定制推理芯片Jalapeño的首批性能测量结果。根据OpenAI公告,Jalapeño在InferenceX基准测试中使用GPT-OSS 120B模型时,实现了比商用系统更高的每千瓦峰值吞吐量和更低的令牌延迟,同时在DeepSeek R1和Kimi K2模型上表现强劲。
关键要点
- Jalapeño展示了可衡量的效率优势,支持跨模型家族扩展AI部署,同时降低每推理任务的功耗。
- AI辅助设计流程使OpenAI在短短九个月内完成从概念到流片,加速了算术电路和负载优化的迭代。
- 2026年底开始的部署计划标志着多代路线图的开端,将为企业AI基础设施带来速度和效率的持续提升。
Jalapeño性能深度分析
这些结果将Jalapeño定位为应对大型语言模型推理需求增长的战略举措。OpenAI报告称,该芯片在每瓦性能上优于现有商用系统,可降低高容量查询处理的运营成本。效率来自针对性算术电路优化,AI工具在九个月开发周期中帮助精炼设计。
跨模型多功能性
在GPT-OSS 120B、DeepSeek R1和Kimi K2上的基准测试证实,Jalapeño的增益不限于单一架构。这为管理多样模型组合的企业提供了标准化定制芯片的途径,而无需牺牲兼容性。
商业影响与机遇
从商业角度看,Jalapeño的效率指标符合公告中描述的杰文斯悖论,即每千瓦性能提升将鼓励更多AI使用。企业可通过提供更低延迟推理服务、推出实时决策工具或扩展此前成本过高的产品功能来实现货币化。实施挑战包括软件成熟度和生产鉴定,OpenAI正在2026年底部署前解决这些问题。金融和医疗等行业的早期采用者有望通过将这些芯片集成到私有集群中获得竞争优势,同时需应对能源效率报告和数据中心合规等监管考虑。
未来展望
OpenAI的路线图显示对定制硬件的持续投资,Gen 2已深入开发,Gen 3正在成型。行业分析师预计这一轨迹将加剧超大规模提供商与芯片设计者之间的竞争,推动行业范围内推理成本下降,同时提高注重可持续计算增长的道德AI部署实践标准。
常见问题
什么是Jalapeño?
Jalapeño是OpenAI首款定制推理芯片,旨在提升每千瓦吞吐量并降低GPT-OSS 120B等模型的令牌延迟。
Jalapeño何时部署?
OpenAI计划在2026年底前在其计算基础设施中开始部署Jalapeño,届时将完成生产鉴定和软件成熟化。
AI如何助力Jalapeño开发?
AI工具使团队在九个月内从初始设计完成流片,通过缩短设计循环并优化算术电路实现更高计算密度。
Greg Brockman
@gdbPresident & Co-Founder of OpenAI