AMAZINGINDEX.COM 日报快照
57.4
VOL. 2026.06
2026.06.25
← 返回 2026.06.25 日报
日报快照 · Daily Snapshot
NO. 016

OpenAI 自研推理芯片首曝

#ARTICLE HackerNews 2026.06.25
推荐指数 55.0 NO. 016 · 2026.06.25
发布2026/06/24Score187Comments161

OpenAI 与博通联合推出首款定制推理芯片 Jalapeño,由其 AI 模型辅助设计,测试阶段能效比已优于现有方案。这是 OpenAI 摆脱英伟达依赖的关键一步,也将加剧云厂商自研芯片竞赛。

OpenAI 选择先做推理芯片而非训练芯片,是务实之举——推理场景更标准化、验证周期更短,且其推理成本压力远大于训练。博通作为 ASIC 设计老牌厂商,客户名单本就包括 Google TPU 和 Meta MTIA,这意味着 Jalapeño 的 IP 复用和量产风险相对可控。

对 AI 工程师的直接影响:短期内不会撼动 Nvidia 在训练端的地位,但如果你在做大规模模型部署,未来 12-18 个月需要重新评估云厂商的推理定价结构。AWS Trainium/Inferentia、Google TPU v5、OpenAI Jalapeño 的差异化竞争,可能会让推理成本出现结构性下降,现在锁定长期 GPU 合约可能不是最优策略。

意见分歧 152 条评论

核心争论:自研推理芯片能否真正摆脱英伟达依赖,以及内存带宽是否为实际瓶颈

kilroy123

I hope to see something like this, but in a small form factor like the NVIDIA spark. I want a super fast LLM that is Opus 4.6+, like, in ability.

wmf

Memory bandwidth is the bottleneck in the Spark. If you replace the SoC with an optimized ASIC but keep the same 256-bit LPDDR5 the performance will be the same. You can increase performance by using wider memory but that's also more expensive.

phonon

M3 Ultra has a 1024 bit memory bus (819 GB/s) and starts at $3,999 (96GB of RAM). It can be done....

替代方案: NVIDIA SparkM3 UltraGoogle TPULPUCerebras Wafer Scale Engine
查看原文 →