0
2 commits
1 linked in READMEs
updated Jun 11, 2024
superjelly/SPA-VL-DPO_90k
superjelly/SPA-VL-PPO_30k
superjelly/SPA-VL-DPO_30k
1
relaxml/Llama-2-70b-E8PRVQ-3Bit
relaxml/Llama-2-70b-E8PRVQ-4Bit
relaxml/Llama-2-7b-E8PRVQ-3Bit
relaxml/Llama-2-7b-E8PRVQ-4Bit
relaxml/Llama-2-13b-E8PRVQ-4Bit
EchoseChen/SPA-VL-RLHF
The reinforcement learning codes for dataset SPA-VL
48