4 repos
roboflow/multimodal-maestro
streamline the fine-tuning process for multimodal models: PaliGemma 2, Florence-2, and Qwen2.5-VL
2,698
534 commits
roboflow/maestro
rabiulcste/vqazero
visual question answering prompting recipes for large vision-language models
29
19 commits
facebookresearch/mmf
A modular framework for vision & language multimodal research from Facebook AI Research (FAIR)
5,631
942 commits