DeformSmith: Physics Harness-Guided Hierarchical Generation of Deformable Assets for Robot Manipulation Paper • 2609.18620 • Published 6 days ago • 5
JEPA-Anything: Learning Predictive Models across Different Worlds Paper • 2609.20800 • Published 6 days ago • 69
Dream-RSI: Recursive Self-Improvement through Evolving Worlds Paper • 2609.14858 • Published 9 days ago • 243
RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments Paper • 2609.15364 • Published 9 days ago • 81
Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation Paper • 2609.11115 • Published 13 days ago • 173
Marigold V2: Revisiting Diffusion Transformers for Monocular Depth Estimation Paper • 2609.08084 • Published 15 days ago • 70
Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Horizon Navigation Paper • 2608.30396 • Published 23 days ago • 12
Agentic Visual Generation: From Generative Models to Agentic Control Paper • 2609.06758 • Published 17 days ago • 34
TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model Paper • 2609.09158 • Published 15 days ago • 22
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving Paper • 2609.00111 • Published 23 days ago • 313
SolarWM: Open Data and Scalable Training for Long-Horizon Video World Models Paper • 2609.02886 • Published 21 days ago • 117
Scal3R: Learning Efficient Multi-Relative Pose Query for Scalable Online 3D Reconstruction Paper • 2609.04201 • Published 20 days ago • 50
LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation Paper • 2608.30935 • Published 23 days ago • 32
Lucida: Parse, Generate, and Place for Composable Real-to-Sim Scene Modeling Paper • 2608.30821 • Published 23 days ago • 67
Code as Worlds: Agentic Discovery of Executable World Representations for Physical Reasoning Paper • 2608.27549 • Published 27 days ago • 49
Locate Anything in Videos: Rethinking Efficient Generative Spatio-Temporal Video Grounding Paper • 2608.28192 • Published 26 days ago • 17
Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090 Paper • 2608.27370 • Published 27 days ago • 40