Dragonfly 支持直拉 HuggingFace 模型
推荐指数 61.0 NO. 027 · 2026.07.01
发布2026/06/30
为什么值得看
CNCF 项目 Dragonfly v2.5.0 新增直接从 Hugging Face 和 ModelScope 下载模型仓库的能力,无需手动配置镜像源。对于在 K8s 集群中频繁部署大模型的团队,这能显著减少模型分发时间和存储冗余。
编辑判断
之前拉 HuggingFace 模型进 K8s 集群,常见做法是用 init-container 跑 git-lfs 或自建 S3 镜像,既慢又占重复存储。Dragonfly 的 P2P 分发能力相当于给模型层做了 BitTorrent,多节点部署时能省掉 70% 以上的出口带宽和存储冗余。
跟同类方案比,DADI 和 Stargz 主要优化容器镜像懒加载,对动辄几十 GB 的模型文件支持有限;Dragonfly 这次直接把模型仓库当一等公民处理,支持分片缓存和断点续传。如果你在跑多副本的 LLM inference 服务或者分布式训练集群,值得替换掉现有的模型拉取流程。
相关内容
Hugging Face accelerates distribution of models and datasets based on Dragonfly | CNCF Hugging Face 与 Dragonfly 合作,解决大文件下载时带宽瓶颈问题,加速模型和数据集分发。 社区供稿| Hugging Face 使用Dragonfly 加速分发模型和数据集 Dragonfly 解决 Hugging Face 并发下载和带宽打满问题,提升模型数据集分发效率。 Hugging Face | Dragonfly Dragonfly 官方集成文档,指导用户消除存储带宽限制,加速 Hugging Face 模型下载。