AMAZINGINDEX.COM 日报快照
59.8
VOL. 2026.08
2026.08.13
← 返回 2026.08.13 日报
日报快照 · Daily Snapshot
NO. 020

阿里通义千问3.8 2.4T模型开源

#ARTICLE HackerNews 2026.08.13
推荐指数 48.0 NO. 020 · 2026.08.13
发布2026/08/12Score73Comments8

Qwen团队发布了2.4T总参数、A95B架构的FP8量化版本,支持Transformers直接加载。对需要本地部署超大模型的团队,这是目前HuggingFace上可直接调用的最大规模开源模型之一。

2.4T参数用FP8量化意味着单节点H100(80GB×8)就能跑起来,之前同量级模型如GPT-4、Claude 3.5 Opus根本没有开源权重。这个尺寸直接对标的是闭源API的经济账——如果你的业务需要长文本推理且月token消耗超过50亿,本地部署的硬件摊销成本会低于调用GPT-4o API。

但要注意FP8的动态范围限制,金融、医疗等对精度敏感的场景建议先做数值稳定性测试。另外HuggingFace页面显示comments仅8条,说明社区还在早期验证阶段,生产环境建议等两周看issue反馈。

意见分歧 9 条评论

核心争论:超大模型开源的实际可运行性存疑,硬件门槛极高

brrrrrm

this is Qwen3.8 max, right? https://qwen.ai/blog?id=qwen3.8

nateb2022

That's my bet, I doubt they'd have the resources to have trained anything substantially larger

efficax

they explicitly say this is qwen3.8 max in the hugging face page

查看原文 →