Hugging Face Blog·· 10 天前精选AI 评分62
Transformers 现已支持运行 llama.cpp 的 GGUF 量化模型
Transformers now runs llama.cpp quants
AI 导读
Hugging Face 为 transformers 加入 GGUF 支持,用户可从 Hub 选取量化检查点,通过 from_pretrained 传入 gguf_file 在本地生成,无需额外配置。
推荐理由
Hugging Face 官方给出在 transformers 中加载 GGUF 的具体方式与性能对比,读者可据此判断本地推理工作流是否值得迁移。
来源:Hugging Face Blog · huggingface.co