This repository provides the code used for image caption which combines the CLIP and current LLMs.
0
stars
1
commits
Python
primary language
Dec 12, 2024
updated
1 commits
zeinhasan/Vision-Language-Model-Image-to-Text-Generation
Vision Language Model - Image to Text Generation
VisionXLab/ProCLIP
Etto48/CVProject
An LLM for captioning images
JUSTUSVMOS/C-MARS
implementation of C-MARS: CLIP-based Multi-modal Attention for Referring Segmentation
microsoft/LLM2CLIP-Llama-3-8B-Instruct-CC-Finetuned
43
fblissjr/cogvlm-image-caption
Using CogVLM and CogAgent for image captioning
15
zlab-princeton/i1-1B
2
GoodBaiBai88/M3D-Cap
99.7%