跳到正文
原文
Hugging Face Blog·· 2024-09-18精选AI 评分60

Hugging Face 把 Llama3 8B 微调到 1.58bit:极低比特量化实践

Fine-tuning LLMs to 1.58bit: extreme quantization made easy

AI 导读

Hugging Face 团队基于微软 BitNet 架构,成功将 Llama3 8B 微调到 1.58bit,每个参数只用 -1、0、1 三个值表示,模型已发布在 HF1BitLLM 组织下。

推荐理由

Hugging Face 团队公开了把已有 Llama3 8B 微调到 1.58bit 的完整流程与踩坑记录,可迁移到其他模型的极低比特量化。

来源:Hugging Face Blog · huggingface.co