RefineSVG: Visual Feedback-Driven Reinforcement Learning for Image-to-SVG Generation Paper • 2607.27699 • Published Jul 30 • 1
TrustRoboReward: Preference-Ordered Isotonic Score Editing for Multi-Paradigm Robot Reward Models Paper • 2608.08491 • Published Aug 9 • 1
Length-Adaptive Decoding for Masked Diffusion Machine Translation Paper • 2608.22274 • Published 17 days ago • 4
TrustJudge: Inconsistencies of LLM-as-a-Judge and How to Alleviate Them Paper • 2509.21117 • Published Sep 25, 2025 • 30
Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future Paper • 2508.06026 • Published Aug 8, 2025 • 15