Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 12 days ago • 308
Beyond Solver Verdicts: Generative Reward Models for Autoformalization Paper • 2609.11085 • Published 9 days ago • 34
World-to-Wrist: Task-Conditioned Future Wrist Modeling for Fine-Grained Robot Manipulation Paper • 2608.05369 • Published Aug 5 • 27
Distill Where You Fail: Recovering Learning Signals of Negative RL-Groups from Adaptive Teacher Guidance Paper • 2608.00782 • Published Aug 1 • 18
CAPEval: A Decoupled Caption Evaluation across Understanding and Generation Paper • 2608.02589 • Published Aug 3 • 26
SKT: Skill-Use Training at Scale via Verified Synthetic Data Generation Paper • 2608.02287 • Published Aug 3 • 32