AMD MI355X 跑 2.8T 模型性价比超 B300
推荐指数 65.0 NO. 011 · 2026.08.03
发布2026/08/02Score199Comments95
为什么值得看
AMD 在 MI355X 上运行 2.8T 参数的 Kimi K3 达到 952 tok/s/node,性能每美元优于英伟达 B300。开源模型参数规模正从百亿级跃升至万亿级,内存带宽和容量成为新的基础设施瓶颈。
编辑判断
这个 benchmark 的隐含信号比数字本身更重要:当模型权重超过 1.5TB,单卡 HBM 容量成为硬约束,互联带宽和显存扩展方案(如 AMD 的 Infinity Fabric)的权重会超过峰值算力。
英伟达 B300 的护城河是 CUDA 生态,但推理场景下模型权重远大于代码量,迁移成本被摊薄。如果 Kimi K3 这类 MoE 模型实际激活参数占比低于 15%,AMD 的显存容量优势会被进一步放大。
做推理 infra 的团队应该重新测算:在 2T+ 模型时代,单 token 成本公式里显存租金的权重是否已经超过了 FLOPS。
社区反馈
负面 55 条评论
核心争论:wafer.ai 的 MI355X 对比 B300 基准测试是否公平可信
相关内容
AI slop
Yeah I think they at least put some light effort into making it readable though. Obviously slop but not quite as bad as most slop articles.
There is barely any effort, a simple GPT5.6 sol pro query rips the post apart.