2026年8月25日,OpenAI 公布其首款定制推理芯片 Jalapeño 技术细节,宣称在响应速度与能效上跑赢英伟达 GB300。据第三方分析机构 SemiAnalysis 实测:在 GPT-OSS 120B、DeepSeek R1 670B 等模型上,Jalapeño 每瓦完成的 AI 工作量超出英伟达 GB200 与 GB300 的 1.5 至 1.9 倍,端到端延迟则缩短到后者的 30%–60%。Jalapeño 由 OpenAI 与博通合作开发,从零到量产仅用了 9 个月。
与此同时,财联社 8 月 27 日报道援引多家机构分析师判断:推理芯片正对英伟达增长最快业务的利润率构成实质威胁,预计 2028 年定制 ASIC 出货量将超过 GPU。报告期内,英伟达 962 亿美元的单季营收虽然创下历史新高,但其「卖铲子」生意的高利润率正被定制芯片、推理专用芯片与自研芯片三条路径同时挤压。
另据公开信息,英伟达在 GTC 2025 春季已推出 NVHBM,并声称其带宽比 HBM4E 内存提升 30%、能效提升 15%;AWS 也已成为首家采用 NVHBM 的合作方。这场芯片战争正从单一性能比较进入「标准化全栈」的对决阶段。
AICOR 点评:Jalapeño 的发布意味着 OpenAI 用行动验证了「头部模型公司≠采购方」的另一面——它已经成为「自己造铲子的人」。对国内玩家而言,这既是好消息也是警钟:ASIC 路线被头部公司自证可行,会让更多国内外大厂走「自研推理芯片+少量商业 GPU」的混合路线,英伟达高利润结构将被进一步压缩。值得提早布局的是与 ASIC 配套的封装、内存、互连和软件栈——英伟达真正的护城河早已不是 GPU 本身,而是 CUDA 生态与 NVLink、NVHBM 这类互连/内存护城河。这也是下一阶段国产算力需要正面强化的方向。
Aviso de Copyright Este artículo está asistido por IA, reescrito a partir de reportajes públicos. El copyright de la información pertenece a los autores y medios originales; el contenido es solo para compartir información del sector y no constituye asesoramiento de inversión ni comercial.
Por cuestiones de copyright, contacte a AICOR (400-601-8080 / WeChat: aicor-ai); lo gestionaremos con prontitud al recibir la notificación.