3 repos
codezakh/LilT
[ICLR 23] Contrastive Aligned of Vision to Language Through Parameter-Efficient Transfer Learning
40
14 commits
mzhaoshuai/RLCF
[ICLR 2024] Test-Time RL with CLIP Feedback for Vision-Language Models.
103
5 commits
dandelin/ViLT
Code for the ICML 2021 (long talk) paper: "ViLT: Vision-and-Language Transformer Without…
1,538
19 commits