Meta-Awareness Enhances Reasoning Models: Self-Alignment Reinforcement Learning
Doohyuk Jang
jadohu
AI & ML interests
None yet
Recent Activity
upvoted a paper about 16 hours ago
J-Zero: Unified Challenger--Solver--Judge Co-Evolution from Zero Data upvoted a paper about 2 months ago
Be My Tutor: On-Policy Co-Distillation for Mutual LLM Improvement via Peer Feedback