11 repos
Experimental implementations and variations of CLIP transcoder models, focusing on different architectural configurations and compression parameters. The repositories appear to be systematic explorations of model compression and efficiency optimizations for vision-language models, with naming conventions suggesting iterations across different patch counts, rank dimensions, and MLP configurations. These represent research-oriented experiments rather than a polished production library ecosystem.