124
stars
37
commits
3
linked in READMEs
Mar 6, 2023
updated
Split of hh-static used for training reward models after supervised fine-tuning.
37 commits
yitingxie/rlhf-reward-datasets
67
Dahoas/static-hh
21
Dahoas/full-hh-rlhf
92
HuggingFaceH4/rs_test
0
HuggingFaceH4/testing_h4
HuggingFaceH4/h4-tests-format-dpo-dataset
HuggingFaceH4/test-dataset-all-splits
1
HuggingFaceH4/hh-rlhf-h4
7
shibing624/MedicalGPT
MedicalGPT: Training Your Own Medical GPT Model with ChatGPT Training Pipeline.…
5,794
shibing624/textgen
TextGen: Implementation of Text Generation models, include LLaMA, BLOOM, GPT2, BART, T5, SongNet…
981
luzhenhai/MedicalGPT