阿里开源27B多模态模型Qwen 3.8
推荐指数 72.0 NO. 011 · 2026.08.15
发布2026/08/14Score418Comments308
为什么值得看
Qwen 3.8-27B-FP8 是阿里通义千问系列的新开源模型,支持图像+文本多模态输入,提供 FP8 量化版本降低推理门槛。对需要本地部署多模态能力的团队,这是目前性价比最高的选择之一,308 条 HN 讨论集中在实际推理性能和显存占用。
编辑判断
FP8 量化在这个级别模型上的可用性是关键信号。之前 27B 级别的多模态模型跑 FP16 需要 54GB+ 显存,FP8 把门槛压到单卡 48GB 甚至 24GB 可跑,这让中小型团队本地部署成为可能。
对比 Llama 3.2 Vision 和 Molmo,Qwen 3.8 的中文理解和 OCR 精度有明显优势,但 HN 评论里提到的注意力机制变体是否带来延迟增加,需要实际压测验证。
如果你在做文档理解、UI 自动化或需要离线运行的视觉 Agent,建议优先测这个而不是继续等 GPT-4V 级别的 API 降价。
社区反馈
正面 250 条评论
核心争论:27B密集模型能否在消费级硬件上替代超大闭源模型
相关内容
阿里Qwen3.8正式发布,编程与办公再进化 阿里正式发布Qwen3.8-Max,参数规模2.4万亿,激活参数95B,支持100万上下文Tokens,下周将开源Qwen3.8-Max权重及Qwen3.8-27B模型。 千问大模型_AI大模型_一站式大模型推理和部署服务 阿里云千问大模型平台上线Qwen3.8-Max,支持百万级上下文与长视频理解,可胜任复杂任务,推出Token Plan个人版。 Qwen3.8-Max: A New Bar for Coding and Cowork Qwen3.8-Max在编程与协作领域树立新标杆,基于真实淘宝天猫数据构建E-Commerce Bench长周期电商运营评测基准。
Really excited to see what people do with this. 3.7 27B was probably the best compromise between size and intelligence to run on consumer hardware
This is one of the most important model releases since most use cases don't need SOTA/Frontier If you want Qwen3.8-27B Serving Configs for the DGX Spark vLLM NVFP4 and RTX 4090 llama.cpp GGUF I added the setups here https://x.com/ErdalToprak/status/2088299678085308761?s
These are massive improvements - and something you can actually run on a laptop.