arXiv:2005.10356 · 1 repo reference this paper in their README
cilinyan/ReVOS-api
22
·
[ECCV24] VISA: Reasoning Video Object Segmentation via Large Language Model