Rethinking On-Policy Distillation of Large Language Models II: One Training Example Paper • 2609.04172 • Published 1 day ago • 49
ForgeWM: Progressive Causal Training for Few-Step Action-Conditioned Video World Models Paper • 2608.14022 • Published 21 days ago • 24
PACE-Bench: Benchmarking Physics Adaptation via Code Evolution in Dynamic Environments Paper • 2608.14441 • Published 21 days ago • 29