OpenAI公布首款自研推理芯片Jalapeño:有实测结果,但不等于全面替代GPU
CoinMeta
8小时前
Ai 焦点
OpenAI在8月25日首次披露自研推理芯片Jalapeño的测量结果。公司称,在使用GPT-OSS 120B的公开InferenceX基准中,这款芯片相较参与比较的商用系统实现了更高的峰值每千瓦吞吐量和更低的token延迟;在DeepSeek R1与Kimi K2上也表现强劲。OpenAI表示,当前已经拥有可工作的第一方芯片,后续代际也在开发中。
有帮助
No.帮助

OpenAI在8月25日首次披露自研推理芯片Jalapeño的测量结果。公司称,在使用GPT-OSS 120B的公开InferenceX基准中,这款芯片相较参与比较的商用系统实现了更高的峰值每千瓦吞吐量和更低的token延迟;在DeepSeek R1与Kimi K2上也表现强劲。OpenAI表示,当前已经拥有可工作的第一方芯片,后续代际也在开发中。

这次发布的准确边界是“首批测量结果”,不是Jalapeño已经大规模铺进所有数据中心,更不是训练和推理都迁移到自研硬件。公开文章没有给出量产规模、制程、单卡功耗、内存容量、系统售价或完整部署时间表,也没有说明比较系统的全部配置。可以确认的是OpenAI已经把模型、服务软件、芯片、内存与网络协同设计从规划推进到可测硅片阶段;不能确认的是它在真实业务总拥有成本上已经普遍领先。

每千瓦吞吐与token延迟要同时看,峰值不能代替持续负载

推理芯片竞争常被简化为每秒生成多少token,但大规模服务还受到首token时间、token间延迟、并发用户、批处理大小、模型精度、上下文长度、内存带宽和功耗约束。OpenAI特别强调在既定token间延迟下扩大吞吐,以及用每千瓦吞吐衡量能效,说明Jalapeño瞄准的是持续运行的推理经济性,而非只追求单一峰值算力。

使用GPT-OSS 120B作为公开基准有利于外部比较,因为测试对象不是公司内部不可获得的私有模型;DeepSeek R1和Kimi K2的结果则用于证明优化并非只绑定一个模型家族。不过,新闻稿没有同步公开足够细的原始数据、软件版本、精度模式、批量参数和复现实验脚本。不同系统若在量化精度、延迟目标或机架功率定义上不一致,排名可能发生变化。因此现阶段更适合把结果视为第一方性能声明,等待InferenceX条目和第三方复测补充。

芯片与模型共同优化能减少通用硬件为兼容众多工作负载保留的冗余,但也带来生命周期风险。模型架构变化速度通常快于芯片设计和制造周期,今天为注意力、混合专家或特定内存访问方式优化的硬件,未来可能面对不同计算图。OpenAI要证明的不只是首代芯片能跑得快,还要证明编译器、运行时与软件栈可以随模型变化保持利用率。

能效也不只等于芯片功耗。机架网络、内存、冷却、电源转换和低利用率待机都会影响数据中心实际每token耗电。峰值每千瓦吞吐是重要指标,却不能直接推导全年平均成本。真正决定商业价值的是在真实请求波动、长上下文、工具调用和多模型路由下,系统还能否保持同样优势。

自研芯片增加的是供应选择与议价能力,不是结束合作

OpenAI把Jalapeño定位为合作伙伴加速器之外的一条可信第一方路径。公司明确列出Microsoft与NVIDIA对其增长的基础作用,并表示计算组合还包括AWS、AMD、Broadcom、Cerebras、CoreWeave、Oracle、SB Energy和SoftBank。不同训练、批量推理、低延迟推理和常驻智能体任务需要不同硬件,企业会把负载放到性能与成本最匹配的系统,而不是只押注一种芯片。

对OpenAI而言,自研芯片的战略价值有三层。第一,针对自身高频推理形态优化,降低边际服务成本;第二,在供应紧张时增加可控产能路线;第三,通过可替代选择维持采购议价能力。即使Jalapeño占比不高,只要能承接足够多稳定工作负载,也可能影响外部加速器价格和部署节奏。

这种控制力仍依赖制造、封装、HBM、网络与数据中心建设伙伴。所谓“自研”通常指架构和系统设计由公司主导,不代表所有物理环节都由OpenAI完成。供应链良率、软件迁移成本和新代际迭代都会决定它能否从测量芯片走到稳定生产。文章没有公布量产日期,因此不应把“已经有工作硅片”写成“已全面商用”。

对云服务和API用户而言,Jalapeño短期内未必改变产品接口。更高能效可能为更低延迟、更高配额或更低单位成本创造空间,但是否传导到价格由容量、需求和产品策略共同决定。用户更应关注服务等级、模型一致性和隐私边界,而不是假设自研芯片会自动带来降价。

这次披露真正改变的是OpenAI在计算栈中的位置:它不再只是大型加速器买家,而开始拥有可测量的第一方推理硬件。下一阶段需要验证的不是宣传中的“领先”,而是公开基准能否复现、真实集群能否长期稳定运行、部署规模如何扩大,以及公司能否在继续使用多家伙伴的同时,把自研硬件变成持久而非一次性的经济杠杆。

来源:OpenAI,The full stack behind abundant intelligence,2026年8月25日,https://openai.com/index/the-full-stack-behind-abundant-intelligence/

打赏
$0
点赞
0
收藏
0
浏览量 34
币界网提醒,请广大读者理性看待区块链,切实提高风险意识,警惕各类虚拟代币发行与炒作, 站内所有内容仅系市场信息或相关方观点,不构成任何形式投资建议。如发现站内内容含敏感信息,可点击“举报”,我们会及时处理。
提交
评论 0
最热
最新
还没有人评论哦~快抢沙发吧!
相关阅读
web3: 比特币周五将迎64亿美元期权到期
Deribit 周五将有约 64.4 亿美元比特币期权到期,市场关注 7.5 万至 8 万美元附近持仓与对冲带来的短线波动。
Cryptonews
·2026-08-26 17:11:21
27
web3: Bitfire推出合规加密量化策略,RWA资管规模超20亿港元
Bitfire称其可贡献利润的资管规模超过20亿港元,并推出合规加密量化策略,面向专业及机构投资者扩张RWA业务。
Cryptonews
·2026-08-26 17:11:18
20
web3: 外媒:X或将上线加密交易功能
外媒称,X 前产品负责人暗示平台或将推出加密交易,市场同时关注 X 支付功能是否会纳入加密资产。
Watcher.Guru
·2026-08-26 16:59:15
31
波音获F-15合同框架上限1312亿美元
波音获得F-15项目长期军工合同,框架上限1312.3亿美元,实际收入仍取决于后续订单。
Coinpaper
·2026-08-26 16:07:27
29
web3: X测试加密交易按钮,或接入BTC与ETH等资产
X 正测试加密交易按钮,未来或在帖文图表中接入 BTC、ETH、XRP 等资产交易跳转。
CoinPedia
·2026-08-26 15:24:36
46
查看更多