Mistral 开源 675B MoE 旗舰模型
推荐指数 89.0 NO. 001 · 2026.06.15
为什么值得看
Mistral 3 系列发布,包含 3B/8B/14B 小模型及 675B 总参数 MoE 架构的 Mistral Large 3,全部 Apache 2.0 开源。对需要私有化部署又不想牺牲性能的团队,这是目前商用友好度最高的顶级模型选项。
编辑判断
Mistral 选择 Apache 2.0 而非 Llama 式的限制性许可,直接瞄准企业合规采购的痛点——很多公司法务会卡 Llama 的商用条款。675B 总参数 / 41B 激活的 MoE 设计也意味着推理成本可控,单卡 A100 通过量化能跑,这对想替代 GPT-4 但数据不能出内网的金融、医疗客户是刚需。
小模型矩阵(3B/8B/14B)的意图很明显:抢端侧和边缘计算场景,跟 Qwen、Gemma 正面交锋。做 AI Agent 基础设施的团队可以重点测 14B 的 tool use 能力,如果接近 Llama 3.1 70B 水平,那就是性价比重构。