AMAZINGINDEX.COM 日报快照
55.3
VOL. 2026.08
2026.08.15
← 返回 2026.08.15 日报
日报快照 · Daily Snapshot
NO. 011

阿里开源27B多模态模型Qwen 3.8

#ARTICLE HackerNews 2026.08.15
推荐指数 72.0 NO. 011 · 2026.08.15
发布2026/08/14Score418Comments308

Qwen 3.8-27B-FP8 是阿里通义千问系列的新开源模型,支持图像+文本多模态输入,提供 FP8 量化版本降低推理门槛。对需要本地部署多模态能力的团队,这是目前性价比最高的选择之一,308 条 HN 讨论集中在实际推理性能和显存占用。

FP8 量化在这个级别模型上的可用性是关键信号。之前 27B 级别的多模态模型跑 FP16 需要 54GB+ 显存,FP8 把门槛压到单卡 48GB 甚至 24GB 可跑,这让中小型团队本地部署成为可能。

对比 Llama 3.2 Vision 和 Molmo,Qwen 3.8 的中文理解和 OCR 精度有明显优势,但 HN 评论里提到的注意力机制变体是否带来延迟增加,需要实际压测验证。

如果你在做文档理解、UI 自动化或需要离线运行的视觉 Agent,建议优先测这个而不是继续等 GPT-4V 级别的 API 降价。

正面 250 条评论

核心争论:27B密集模型能否在消费级硬件上替代超大闭源模型

TomGarden

Really excited to see what people do with this. 3.7 27B was probably the best compromise between size and intelligence to run on consumer hardware

erdaltoprak

This is one of the most important model releases since most use cases don't need SOTA/Frontier If you want Qwen3.8-27B Serving Configs for the DGX Spark vLLM NVFP4 and RTX 4090 llama.cpp GGUF I added the setups here https://x.com/ErdalToprak/status/2088299678085308761?s

chvid

These are massive improvements - and something you can actually run on a laptop.

替代方案: Claude Opus 4.6Claude Opus 4.7 Maxllama.cppvLLM
查看原文 →