3
stars
2
commits
1
linked in READMEs
Jun 29, 2024
updated
2 commits
xinlai/Qwen2-72B-SFT-Step-DPO
xinlai/Qwen2-7B-SFT
0
xinlai/Qwen2-72B-SFT
xinlai/Qwen2-57B-A14B-SFT
binxia/llmga-Qwen2-7B-full-finetune
xinlai/Qwen1.5-32B-SFT
TommyChien/memorag-qwen2-7b-inst
12
demo911/UnifiedThinker-7B
dvlab-research/Step-DPO
Implementation for "Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs"
397