Skip to content

Towards Better Alignment: Training Diffusion Models with Reinforcement Learning Against Sparse Rewards.

Zijing Hu, Fengda Zhang, Long Chen, Kun Kuang, Jiahui Li, Kaifeng Gao, Jun Xiao, Xin Wang, Wenwu Zhu

VenueA*CVPR
Year2025
ProceedingsCVPR

Browse the full CVPR paper archive.