GRPO & Diffusion Model Optimization

11 repos

Reinforcement learning approaches for optimizing diffusion models and text-to-image generation, centered on GRPO (Group Relative Policy Optimization) and related techniques. These repositories explore methods for improving reward-driven training in generative models, with implementations spanning multiple frameworks (PyTorch, Paddle) and applications to visual generation tasks. The cluster includes both core algorithmic work and framework-specific variants for enhancing model performance through policy optimization.

Python · 9
reinforcement-learning ·1,243
diffusion ·1,243
grpo ·1,243
text2image ·66
diffusers ·12
safetensors ·12
text-to-image ·4