跳到正文
原文
Hugging Face Blog·· 2023-09-29AI 评分50

用 TRL 的 DDPO 微调 Stable Diffusion 模型

Finetune Stable Diffusion Models with DDPO via TRL

AI 导读

Hugging Face 在 trl 库中集成 DDPOTrainer,可用 DDPO(Denoising Diffusion Policy Optimization)对 Stable Diffusion 做强化学习微调。

来源:Hugging Face Blog · huggingface.co