OpenAI 自研推理芯片首曝
推荐指数 55.0 NO. 016 · 2026.06.25
发布2026/06/24Score187Comments161
为什么值得看
OpenAI 与博通联合推出首款定制推理芯片 Jalapeño,由其 AI 模型辅助设计,测试阶段能效比已优于现有方案。这是 OpenAI 摆脱英伟达依赖的关键一步,也将加剧云厂商自研芯片竞赛。
编辑判断
OpenAI 选择先做推理芯片而非训练芯片,是务实之举——推理场景更标准化、验证周期更短,且其推理成本压力远大于训练。博通作为 ASIC 设计老牌厂商,客户名单本就包括 Google TPU 和 Meta MTIA,这意味着 Jalapeño 的 IP 复用和量产风险相对可控。
对 AI 工程师的直接影响:短期内不会撼动 Nvidia 在训练端的地位,但如果你在做大规模模型部署,未来 12-18 个月需要重新评估云厂商的推理定价结构。AWS Trainium/Inferentia、Google TPU v5、OpenAI Jalapeño 的差异化竞争,可能会让推理成本出现结构性下降,现在锁定长期 GPU 合约可能不是最优策略。
社区反馈
意见分歧 152 条评论
核心争论:自研推理芯片能否真正摆脱英伟达依赖,以及内存带宽是否为实际瓶颈
相关内容
OpenAI自研芯片内幕曝光!18个月前开始用AI优化芯片设计 OpenAI与博通合作部署10GW规模,CEO奥特曼和总裁Greg Brockman出席合作活动,芯片设计已用AI优化。 OpenAI 计划自研 AI 芯片,以减少对英伟达的依赖 OpenAI组建约20人研发团队,含谷歌Tensor前首席工程师,博通协助设计、台积电代工,预计2026年生产。 OpenAI首颗自研芯片要来了,打响抛弃英伟达第一枪 分析师预测推理芯片需求将超训练芯片,OpenAI自研芯片瞄准推理市场,降低对英伟达依赖。 OpenAI携手博通推出首款自研芯片全力构建全栈技术体系 ASIC芯片仅9个月完成设计,配套系统模块大量自研,实体样片已交付,计划2026年底初步部署。
I hope to see something like this, but in a small form factor like the NVIDIA spark. I want a super fast LLM that is Opus 4.6+, like, in ability.
Memory bandwidth is the bottleneck in the Spark. If you replace the SoC with an optimized ASIC but keep the same 256-bit LPDDR5 the performance will be the same. You can increase performance by using wider memory but that's also more expensive.
M3 Ultra has a 1024 bit memory bus (819 GB/s) and starts at $3,999 (96GB of RAM). It can be done....