11 repos
Generative model optimization using reinforcement learning techniques, primarily focused on diffusion-based image generation and text-to-image synthesis. The cluster centers on GRPO (Group Relative Policy Optimization) and related RL methods applied to diffusion models for improving generation quality, with implementations spanning PyTorch, Paddle, and various visual generation tasks including dance motion synthesis. Repositories here explore how to leverage reward signals and policy optimization to enhance both text-to-image and visual generative models.