Kimi 获阿里 2 万张 GPU 集群
推荐指数 52.0 NO. 011 · 2026.08.01
发布2026/07/31Score94Comments54
为什么值得看
月之暗面(Moonshot)的 Kimi 大模型正在使用阿里云提供的 2 万张英伟达芯片集群进行训练。这是中国大模型公司获得的最大规模算力支持之一,意味着国产头部模型与云厂商的绑定正在加深,算力军备竞赛进入新阶段。
编辑判断
2 万张 H100/H800 级别的集群在国内属于顶级算力配置,但关键问题是训练效率——Meta 的 Llama 3 用 1.6 万张 H100 训练时,有效算力利用率(MFU)约 38%。阿里云的集群管理和网络拓扑能否支撑高 MFU 是隐藏瓶颈。
更值得看的是商业条款:这是纯采购、算力换股权、还是收入分成?国内云厂商去年开始收紧对 AI 初创的免费算力支持,Kimi 能拿到这个规模,说明其用户增长数据对阿里有足够说服力,或已谈定优先上云条款。做国产模型 infra 的团队应关注阿里云后续是否开放同类集群的对外租赁定价。
社区反馈
意见分歧 50 条评论
核心争论:Kimi 3是否靠架构效率而非蒸馏实现低成本训练,以及中国模型效率优势是否可持续
相关内容
Interesting if true - that Moonshot can train a ~3T SOTA model on only 20K NVIDIA GPUs, while others like Musk (who freely admits to distilling OpenAI's models) struggle to build a competitive 1T model (Grok 4.5) with massively more compute (Colossus-1 100-250K GPUs, Colossus-2 500K+ GPUs). I guess
> Musk (who freely admits to distilling OpenAI's models) Source?
https://www.forbes.com/sites/antoniopequenoiv/2026/04/30/elo...