SFT Conflicts, RL Coexists: A Theoretical and Empirical Analysis of Multi-Task Learning for LLMs Paper • 2608.03573 • Published 9 days ago • 52
Sci-VBench: Evaluating Knowledge- and Reasoning-Intensive Video Generation in Science Domains Paper • 2608.09873 • Published 5 days ago • 29
Progressive Agent Skill Generation via Reinforcement Learning Paper • 2608.01678 • Published 12 days ago • 58
UEmbed: Unified Sparse and Dense Multimodal Embeddings Paper • 2608.02583 • Published 12 days ago • 50
GUI vs. CLI: Execution Bottlenecks in Screen-Only and Skill-Mediated Computer-Use Agents Paper • 2606.24551 • Published Jun 22 • 28