adityaemmanuel/explainable-rl-alignment

This repository contains all the work as part of our research work exploring breaking down human-preference data into explainable components to perform large language model alignment.

1

stars

20

commits

Python

primary language

Apr 21, 2024

updated

README

explainable-rl-alignment

This repository contains all the work as part of our research work exploring breaking down human-preference data into explainable components to perform large language model alignment.

Contributors

adityaemmanuel

10 commits

JennyShen056

6 commits

poojakabber7

4 commits

adityaemmanuel/explainable-rl-alignment

This repository contains all the work as part of our research work exploring breaking down human-preference data into explainable components to perform large language model alignment.

1

stars

20

commits

Python

primary language

Apr 21, 2024

updated

README

explainable-rl-alignment

This repository contains all the work as part of our research work exploring breaking down human-preference data into explainable components to perform large language model alignment.

Contributors

adityaemmanuel

10 commits

JennyShen056

6 commits

poojakabber7

4 commits

Languages

Python

98.4%

Shell

1.6%