OpenAI首款自研芯片Jalapeño亮相:推理性能超Nvidia Blackwell 1.5倍

OpenAI在Hot Chips 2026会议上公布了首款自研AI芯片Jalapeño的基准测试结果。这不是训练芯片,而是专门干”推理”活的——也就是ChatGPT回复你、API响应请求时做的计算。

核心看点一:性能数据

测试覆盖多个公开模型(GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 1T等),结果:

  • 性能功耗比:比Nvidia Blackwell(GB200/GB300)高1.5-1.9倍
  • 延迟:降低1.7-3.6倍,最高可达4.1倍
  • 高交互负载吞吐量:提升2.1-4.1倍
  • 单芯片功耗:约700W,远低于Nvidia同类的1400W

芯片采用HBM4内存、权重驻留脉动阵列、乱序执行核心等专用架构,重点优化KV Cache和内存搬运。

核心看点二:战略意义

OpenAI目前训练和推理都主要靠Nvidia GPU。推理是日常开销大头——每次你问ChatGPT一个问题,都要烧算力。自研芯片能把这部分成本压下来。

Jalapeño由台积电代工,OpenAI+Broadcom联合设计,从设计到流片用了约9-16个月。部署计划:2026年底小规模上线,2027年扩到100MW级。

芯片不对外卖,仅供内部使用。机架架构叫Katsu-Vindaloo-Chana,可扩展到2048颗芯片。

核心看点三:行业影响

Sam Altman发推说”We made a chip and it is fast”。

这件事的意义在于:AI公司开始从”买GPU”转向”自己造芯片”。但注意,Jalapeño只针对推理,训练还是Nvidia的天下,CUDA生态短期内动不了。

2027年规模化部署后,真实成本节省效果值得关注。对Nvidia来说,推理市场这块肥肉终于有人来抢了。

本文地址:https://www.163264.com/15258

(0)
上一篇 14小时前
下一篇 14小时前

相关推荐