6
stars
19
commits
10
repos using this model
1
linked in READMEs
Jan 17, 2023
updated
19 commits
CarperAI/trlx
A repo for distributed training of language models with Reinforcement Learning via Human Feedback…
4,753
GanjinZero/RRHF
[NIPS2023] RRHF & Wombat
804
callummcdougall/ARENA_2.0
Resources for skilling up in AI alignment research engineering. Covers basics of deep learning,…
248
Dahoas/reward-modeling
98
Improbable-AI/curiosity_redteam
Official implementation of ICLR'24 paper, "Curiosity-driven Red Teaming for Large Language Models"…
90
opentensor/text-prompting
28
alecwangcq/f-divergence-dpo
Direct preference optimization with f-divergences.
17
opentensor/validators
Repository for bittensor validators
16
CSQianDong/RLCF
Repo. for RLCF.
15
kmy17518/ESREAL
[ECCV 2024] Official PyTorch implementation of ESREAL