8 repos
PKU-Alignment/align-anything
Align Anything: Training All-modality Model with Feedback
4,671
127 commits
calisweetleaf/Reinforcement-Learning-Full-Pipeline
This repository provides a production-grade implementation of the Reinforcement Learning from Human…
12
22 commits
ContextualAI/HALOs
A library with extensible implementations of DPO, KTO, PPO, ORPO, and other human-aware loss…
909
335 commits
sail-sg/oat
🌾 OAT: A research-friendly framework for LLM online alignment, including reinforcement learning,…
670
68 commits
YangLing0818/IterComp
[ICLR 2025] IterComp: Iterative Composition-Aware Feedback Learning from Model Gallery for…
202
17 commits
Miraclemarvel55/LLaMA-MOSS-RLHF-LoRA
用RLHF可选LoRA对LLaMA和MOSS进行训练|Training LLaMA or MOSS with RLHF [LoRA]
21
2 commits
dvlab-research/MGM
Official repo for "Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models"
3,324
35 commits
sshh12/multi_token
Embed arbitrary modalities (images, audio, documents, etc) into large language models.
189
84 commits