TailBooster: A Dual-Layer Generative Framework for Extreme Value Augmentation with Operational Validity Enforcement Paper • 2608.11951 • Published 7 days ago • 8
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published 18 days ago • 258
On-Policy Delta Distillation for Multilingual Math Reasoning Paper • 2608.05802 • Published 13 days ago • 32
AISPA: User-Centric System Prompt Auditing for Large Language Model Applications Paper • 2607.28617 • Published 20 days ago • 37