Enrich VLMs’ vision-centric reasoning capabilities via Chain-of-Visual-Thought!
YM Qin
Wakals
AI & ML interests
Computer Vision, Vision-language Model, Generative Model
Recent Activity
liked a dataset about 4 hours ago
Wakals/OmniTaskonomy updated a dataset about 4 hours ago
Wakals/OmniTaskonomy published a dataset about 13 hours ago
Wakals/OmniTaskonomyOrganizations
None yet