VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning Paper • 2608.26105 • Published 27 days ago • 189
LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training Paper • 2608.24845 • Published 28 days ago • 16
ReToken: One Token to Improve Vision-Language Models for Visual Retrieval Paper • 2607.28627 • Published Jul 30 • 8
Chain-of-Visual-Thought: Teaching VLMs to See and Think Better with Continuous Visual Tokens Paper • 2511.19418 • Published Nov 24, 2025 • 29 • 4