1
2 commits
1 linked in READMEs
updated Oct 4, 2025
GAIR/ToRL-7B
2
xytian1008/VAPO-Thinker-3B
FanqingM/MM-Eureka-Qwen-32B
konkazzz/GT-r1
0
HuggingFaceH4/Qwen2.5-1.5B-Instruct-gkd
csuhan/tar_1.5B_pretrain_demo
TheToad/Qwen3-8B-VerIH
nyu-visionx/Cambrian-P-7B
mlfoundations/Gelato
🍨 Gelato — From Data Curation to Reinforcement Learning: Building a Strong Grounding Model for…
46