3 repos
SJTU-DENG-Lab/LightningRL
LightningRL: Breaking the Accuracy–Parallelism Trade-off of Block-wise dLLMs via Reinforcement…
33
28 commits
YanJiangJerry/Block-R1
Block-R1: Multi-domain RL Post-training Benchmark for dLLMs.
21
13 commits
YinhanHe123/IAPO
No description
6
7 commits