OpenAI与Broadcom首发定制推理芯片Jalapeño:AI算力新纪元

一颗”辣椒”的野心
OpenAI的芯片梦终于落地。6月25日,OpenAI与Broadcom联合发布了首款定制AI推理芯片——Jalapeño。这个名字取自西班牙语”辣椒”,寓意辛辣、高效。它的出现标志着OpenAI从纯模型公司向”模型+芯片”双轮驱动的关键转型,也是继Google TPU、Amazon Trainium之后,又一家AI巨头摆脱对NVIDIA单一依赖的标志性事件。
Jalapeño专为大语言模型推理优化,而非训练。OpenAI明确表示,这颗芯片的设计目标是在百万级并发请求场景下将推理延迟降低至个位数毫秒,同时将每瓦性能提升三倍以上。对于日处理数十亿次API调用的ChatGPT和GPT系列产品而言,这是一个战略级的基础设施升级。
为什么是Broadcom而不是NVIDIA?
这可能是此次合作最耐人寻味的地方。Broadcom在数据中心网络和定制ASIC领域深耕多年,曾为Google设计多代TPU架构。相比采购NVIDIA的标准GPU,与Broadcom合作定制芯片让OpenAI可以完全掌控架构设计——从内存带宽分配到计算单元排列,一切都为自家Transformer架构的推理特性量身打造。
据华尔街日报报道,Jalapeño采用了先进的chiplet设计,将推理计算单元与HBM3e高带宽内存通过硅中介层紧密集成。初步测试表明,在处理GPT-5.5级别的模型推理时,每token成本有望降低40%以上,能效比提升超过两倍。对于周活用户已突破9亿的ChatGPT而言,这意味着每年可节省数十亿美元的推理成本。
对NVIDIA意味着什么?
短期冲击有限,长期信号明确。NVIDIA当前在AI训练市场仍占绝对主导,Blackwell GPU供不应求的局面短期内不会改变。但Jalapeño的发布释放了一个清晰的产业趋势:头部AI公司正在集体寻求”去NVIDIA化”。
Google有TPU,Amazon有Trainium和Inferentia,微软在秘密推进Maia,Meta持续迭代MTIA,现在OpenAI也正式入局。AI芯片的战国时代已经到来。NVIDIA的护城河并非不可逾越——当最大的客户纷纷变成竞争对手,当推理市场对通用GPU的依赖逐渐松动,垄断地位的挑战将从量变走向质变。
行业连锁反应
Jalapeño的发布直接冲击了多家AI芯片初创公司的估值逻辑。Groq、Cerebras、d-Matrix等专注推理优化的公司面临更强大的竞争对手。与此同时,台积电和三星等先进制程代工厂将迎来更多定制芯片订单,CoWoS先进封装产能的争夺战将进一步白热化。
对开发者生态而言,OpenAI暗示Jalapeño未来可能通过API形式向第三方开放推理服务。如果成真,这意味着AI应用开发者的推理成本将进一步下降,从”可行”走向”可盈利”的应用数量将大幅增加,有望催生新一轮AI应用创业浪潮。
一个时代的开启
Sam Altman在发布会上说:”Jalapeño只是开始。”据知情人士透露,OpenAI已在规划第二代芯片,目标2027至2028年实现训练与推理全覆盖。当AI公司从技术的”消费者”转型为基础设施的”建设者”,行业格局将被彻底重写。AI芯片不再只是NVIDIA的独角戏——一个多极竞争的算力新时代正在到来。
— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn
