6 repos
princeton-nlp/SimPO
[NeurIPS 2024] SimPO: Simple Preference Optimization with a Reference-Free Reward
958
79 commits
general-preference/general-preference-model
[ICML 2025] Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment…
44
41 commits
mzhaoshuai/llama3-ultrafeedback-bertscore-bart-large-mnli
No description
0
9 commits
mzhaoshuai/Llama-3.3-70B-Inst-awq_SafeRLHF
6 commits
line/sacpo
[NeurIPS 2024] SACPO (Stepwise Alignment for Constrained Policy Optimization)
9
8 commits
reward-lens/reward-lens
Measurement instruments for reward models and RL runs. Every reading is either evidence or a…
2
102 commits