OpenAI 的首款定制芯片“Jalapeño”是真的:Broadcom 的 LLM 推理加速器意味着什么
OpenAI 和 Broadcom 推出了 Jalapeo,这是 OpenAI 首款用于 LLM 推理的定制芯片,是 10 吉瓦交易的一部分。这就是它的作用以及它的重要性。
发生了什么
OpenAI有自己的芯片。开 2026 年 6 月 24 日、OpenAI 和 博通 揭幕 墨西哥辣椒,该公司的第一个定制人工智能加速器 - 一块从头开始设计的硅片,用于运行大型语言模型,而不是重新调整用途的图形处理器。 Broadcom 总裁兼首席执行官 Hock Tan 和总裁 Charlie Kawwas 将第一颗芯片交给了 OpenAI 首席执行官 Sam Altman 和总裁 Greg Brockman,这是 OpenAI 推动控制更多其模型运行的硬件的一个象征性时刻。

OpenAI 将 Jalapeo 称为“智能处理器”,它是计划中的国产芯片系列中的第一个。与主导当今人工智能军备竞赛的以训练为中心的硬件不同,第一代的目标是 推论 — 运行完成的模型来回答用户查询的日常工作。简而言之,Jalapeño 的构建是为了让 ChatGPT 和 OpenAI 的其他产品更快、更便宜地大规模提供服务,这些公司的目标是在 2026 年底之前让它处理实际流量。
墨西哥辣椒到底是什么
墨西哥辣椒是一种 专用集成电路 (ASIC) — 为狭窄工作而硬连线的芯片。这使得它的灵活性不如 Nvidia 等通用 GPU,但运行起来更便宜,并且在它的目的之一上效率更高:服务大型语言模型。 GPU 必须擅长所有事情,而 ASIC 可以精确地围绕特定类别的模型如何移动数据和计算进行设计。

至关重要的是,OpenAI 将 Jalapeo 描述为 现代法学硕士推理的空白设计,而不是适应新工作负载的旧版人工智能加速器。 OpenAI 的研究人员将有关前沿模型实际表现的详细见解融入到设计中,因此芯片围绕生产中最重要的事情进行了优化:计算内核、内存移动、芯片之间的网络以及使聊天机器人感觉响应迅速的服务模式。两家公司表示,早期测试表明 Jalapeo 可以实现 每瓦性能明显优于当前最先进的技术 硬件——当能源成为扩展人工智能的最大单一限制时,这是一个大问题。
经济是头条新闻。 Broadcom 首席执行官 Hock Tan 表示 Jalapeo 可以进行推理 大约是典型 AI GPU 成本的一半。按照 OpenAI 的运营量(每天有数亿用户发送查询),即使每个代币成本的小幅削减也会带来计算和电力方面的巨大节省。
从设计到流片九个月
最引人注目的主张之一是速度。 Jalapeo 从最初的设计到制造 流片 - 将完成的芯片设计发送到代工厂进行生产的点 - 只需 九个月。两家公司相信,这是高性能、先进半导体领域有史以来最快的 ASIC 开发周期之一,而对于这种复杂的芯片来说,传统上这个过程需要一年多的时间。
这一速度的部分原因在于 OpenAI 工程师和 Broadcom 芯片团队之间深入的软件和硬件共同开发。但 OpenAI 也表示它使用了 拥有自己的AI模型,加速部分设计和优化工作 ——它为用户提供的相同模型帮助构建了运行未来模型的基础设施。这是一个简洁、稍微递归的说明,说明了行业的发展方向:人工智能帮助设计运行人工智能的芯片。
10吉瓦合作伙伴关系
Jalapeo 是第一个规模更大的混凝土产品。在 2025 年 10 月、OpenAI 与 Broadcom 宣布战略合作开发和部署 10吉瓦 OpenAI 设计的人工智能加速器——计算能力如此之大,以数据中心消耗的功率而不是芯片数量来衡量。 OpenAI 设计加速器及其周围的系统; Broadcom 构建它们并提供将它们连接在一起的网络。

博通的作用远远超出了芯片本身。完整的加速器机架将 完全通过以太网进行扩展 以及其他博通连接,这对于数千个芯片如何作为一个系统协同工作至关重要。加速器和网络机架的部署目标是在 2026年下半年 并贯穿结束 2029年,分布在 OpenAI 自己的设施和合作伙伴数据中心。 Hock Tan 将其定义为“扩展人工智能未来十年所需的物理基础设施的基本承诺”,包括从 2026 年开始与微软和其他合作伙伴共同建造的千兆瓦级数据中心。
构建全栈
战略逻辑是 OpenAI 希望拥有其模型下更多的“全栈”——从芯片到软件。通过将构建前沿模型所学到的知识直接嵌入到硬件中,OpenAI 可以根据自己的工作负载调整系统的每一层,而不是接受现成芯片的权衡。
Tan 直言不讳地说:“归根结底,你不能、也不应该依赖其他第三方 GPU 来为你做这件事,因为它是一个非常关键的部分。”这与苹果、谷歌和亚马逊等公司多年来一直采用的垂直整合策略相同——设计定制芯片以控制成本、性能和供应。对于 OpenAI 来说,其整个业务都取决于计算的价格和可用性,拥有芯片可以说是它可以采取的最具战略意义的举措。
这对 Nvidia 意味着什么
不可避免的潜台词是 英伟达其 GPU 为当今绝大多数人工智能训练和推理提供动力,其稀缺性和价格决定了整个领域的经济性。 OpenAI 是全球最大的人工智能计算消费者之一,因此它为构建替代方案而采取的任何举措都受到整个行业的密切关注。

准确了解墨西哥辣椒是什么和不是什么非常重要。它是一个 推论 芯片,而不是训练芯片,因此它不会直接取代 OpenAI 用于构建新模型的 GPU——至少在第一代中不会。 OpenAI 一直小心翼翼地将 Jalapeo 作为其持续购买的 Nvidia 和 AMD 硬件的补充,而不是批发替代品。但方向很明确:最大的人工智能实验室越来越需要定制芯片来进行大批量、成本敏感的服务模型工作,而且 OpenAI 部署的每一个加速器都不需要从第三方购买。
部署和下一步
OpenAI 计划开始使用 Jalapeo 来处理客户查询 2026 年晚些时候随着更广泛的 10 吉瓦建设的进行,产能在接下来的几年中不断扩大。由于 Jalapeo 被描述为多代平台中的首款芯片,因此未来版本预计将随着时间的推移扩大其功能。

对于最终用户来说,这些都不会直接可见。无需购买任何产品,也无需更改设置。随着时间的推移,它应该转化为: 更快的响应、更高的使用限制和更低的价格 随着 OpenAI 服务每个查询的成本下降。繁重的工程发生在数据中心;回报是更流畅、更便宜的 ChatGPT。
为什么它很重要
Jalapeo 不仅仅是一家公司的芯片发布——它是人工智能行业走向成熟的标志。第一阶段的繁荣取决于谁能获得最多的 GPU。下一阶段的问题是谁可以最有效地运行这些模型,这越来越意味着围绕一组特定的工作负载设计定制芯片。
如果 OpenAI 能够真正以标准 GPU 一半的成本提供推理服务,那么它将改变从免费访问到生产中更大模型的可行性等一切数学问题。它还加深了 OpenAI、博通和微软之间的联系,形成了竞争对手必须应对的硬件供应链。该芯片目前还无法处理您的 ChatGPT 查询,但当它处理时,它将悄然重塑决定人工智能可扩展程度的经济学。公告全文由 博通。