One Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing Paper • 2609.04190 • Published 12 days ago • 8
VTAM: Video-Tactile-Action Models for Complex Physical Interaction Beyond VLAs Paper • 2603.23481 • Published Mar 24 • 7
Fine-Grained Preference Optimization Improves Spatial Reasoning in VLMs Paper • 2506.21656 • Published Jun 26, 2025 • 16