11 repos
TIGER-AI-Lab/General-Reasoner
General Reasoner: Advancing LLM Reasoning Across All Domains [NeurIPS25]
233
32 commits
PRIME-RL/PRIME
Scalable RL solution for advanced reasoning of language models
1,874
75 commits
PRIME-RL/TTRL
[NeurIPS 2025] TTRL: Test-Time Reinforcement Learning
1,123
20 commits
sail-sg/understand-r1-zero
Understanding R1-Zero-Like Training: A Critical Perspective
1,275
39 commits
LLM360/Reasoning360
A repo for open research on building large reasoning models
153
546 commits
bigai-nlco/RuleReasoner
[ICLR 2026] RuleReasoner: Reinforced Rule-based Reasoning via Domain-aware Dynamic Sampling
42
21 commits
ModalityDance/Omni-R1-Zero
No description
0
9 commits
ModalityDance/Omni-R1
8 commits
NVlabs/GDPO
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for…
502
16 commits
xirui-li/Frankenstein
The official implementation for the paper "What does RL improve for Visual Reasoning? A…
4
4 commits
OpenBMB/RLPR
Extrapolating RLVR to General Domains without Verifiers
205
56 commits