Streaming Multi-Agent Autoregressive Diffusion Model with World State Registers Paper • 2607.21594 • Published 3 days ago • 11
electricsheepafrica/africa-ghana-annual-distribution-of-casualties-a4dfb40a Viewer • Updated 7 days ago • 160 • 33 • 1
LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget Paper • 2607.14952 • Published 10 days ago • 199
The Mirage of Optimizing Training Policies: Monotonic Inference Policies as the Real Objective for LLM Reinforcement Learning Paper • 2606.29526 • Published 28 days ago • 170
Reflective Prompt Tuning through Language Model Function-Calling Paper • 2605.21781 • Published May 20 • 9
CollectionLoRA: Collecting 50 Effects in 1 LoRA via Multi-Teacher On-Policy Distillation Paper • 2605.25378 • Published May 25 • 62
epispasm/qwen3.5-9b-nsfw-captioning-v5_from_oldhag88_epispasm_trained_v2_overtrained_gguf 9B • Updated May 28 • 419 • 1