FinanceHarness: Autonomous Financial Deep Research Framework Paper • 2607.27853 • Published Aug 7 • 12
UniSD: Towards a Unified Self-Distillation Framework for Large Language Models Paper • 2605.06597 • Published May 7 • 15
Position: The Hidden Costs and Measurement Gaps of Reinforcement Learning with Verifiable Rewards Paper • 2509.21882 • Published Sep 26, 2025
Trading-R1: Financial Trading with LLM Reasoning via Reinforcement Learning Paper • 2509.11420 • Published Sep 14, 2025 • 5
TradingAgents: Multi-Agents LLM Financial Trading Framework Paper • 2412.20138 • Published Dec 28, 2024 • 143
Advancing AI-Scientist Understanding: Making LLM Think Like a Physicist with Interpretable Reasoning Paper • 2504.01911 • Published Apr 2, 2025 • 1
Scito2M: A 2 Million, 30-Year Cross-disciplinary Dataset for Temporal Scientometric Analysis Paper • 2410.09510 • Published Oct 12, 2024 • 1
Memorize and Rank: Elevating Large Language Models for Clinical Diagnosis Prediction Paper • 2501.17326 • Published Jan 28, 2025
AgentReview: Exploring Peer Review Dynamics with LLM Agents Paper • 2406.12708 • Published Jun 18, 2024 • 8
Benchmarking Foundation Models with Language-Model-as-an-Examiner Paper • 2306.04181 • Published Jun 7, 2023
FinanceHarness: Autonomous Financial Deep Research Framework Paper • 2607.27853 • Published Aug 7 • 12
UniSD: Towards a Unified Self-Distillation Framework for Large Language Models Paper • 2605.06597 • Published May 7 • 15
MARS: Modular Agent with Reflective Search for Automated AI Research Paper • 2602.02660 • Published Feb 2 • 67
DeepSearch: Overcome the Bottleneck of Reinforcement Learning with Verifiable Rewards via Monte Carlo Tree Search Paper • 2509.25454 • Published Sep 29, 2025 • 147
Web-CogReasoner: Towards Knowledge-Induced Cognitive Reasoning for Web Agents Paper • 2508.01858 • Published Aug 3, 2025 • 20
Web-CogReasoner: Towards Knowledge-Induced Cognitive Reasoning for Web Agents Paper • 2508.01858 • Published Aug 3, 2025 • 20
The Invisible Leash: Why RLVR May Not Escape Its Origin Paper • 2507.14843 • Published Jul 20, 2025 • 85
LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts Paper • 2407.04973 • Published Jul 6, 2024