CARE: Experience-Guided Atomic Corrective Execution for Vision-Language-Action Policies Paper • 2609.24118 • Published 4 days ago • 24
Measuring the Checker: Mutation Analysis for GPU-Kernel Benchmark Oracles Paper • 2609.22220 • Published 23 days ago • 7
DeformSmith: Physics Harness-Guided Hierarchical Generation of Deformable Assets for Robot Manipulation Paper • 2609.18620 • Published 8 days ago • 14
OmniVBench: A Benchmark and Large-Scale Dataset for Omni Reference-to-Video Generation Paper • 2609.22069 • Published 7 days ago • 35
SoL-Pi: Recursively Scaling Auto-Research Loops for Efficient Agent Harness Paper • 2609.20519 • Published 8 days ago • 130
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 18 days ago • 373