Hugging Face Blog·· 2023-09-29AI 评分50
用 TRL 的 DDPO 微调 Stable Diffusion 模型
Finetune Stable Diffusion Models with DDPO via TRL
AI 导读
Hugging Face 在 trl 库中集成 DDPOTrainer,可用 DDPO(Denoising Diffusion Policy Optimization)对 Stable Diffusion 做强化学习微调。
来源:Hugging Face Blog · huggingface.co