Drop-Then-Recovery: How Redundant Are Vision-Language-Action Models? Paper • 2606.27755 • Published 26 days ago • 6
Imaginative Perception Tokens Enhance Spatial Reasoning in Multimodal Language Models Paper • 2606.03988 • Published Jun 3 • 126
SemBridge: Language Transfer in Sparse Encoders via Multilingual Semantic Bridges Paper • 2605.26002 • Published May 25 • 5
Learning High-Frequency Continuous Action Chunks in Latent Space Paper • 2605.24931 • Published May 24 • 6
Sensor2Sensor: Cross-Embodiment Sensor Conversion for Autonomous Driving Paper • 2605.22809 • Published May 21 • 27
PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents Paper • 2605.19932 • Published May 19 • 7
DelTA: Discriminative Token Credit Assignment for Reinforcement Learning from Verifiable Rewards Paper • 2605.21467 • Published May 20 • 207