TrackEverything: Long Horizon Dense Tracking via De-Duplicating 3D Scene Representations Paper • 2609.30222 • Published 5 days ago • 7
Uranus: Building the Next-Generation Simulation Infrastructure for Embodied AI Paper • 2609.24815 • Published 6 days ago • 5
HuRo: Robotizing Human Videos for Scalable VLA Pretraining Paper • 2609.10706 • Published 11 days ago • 29
DeformSmith: Physics Harness-Guided Hierarchical Generation of Deformable Assets for Robot Manipulation Paper • 2609.18620 • Published 12 days ago • 23
JEPA-Anything: Learning Predictive Models across Different Worlds Paper • 2609.20800 • Published 12 days ago • 75
Dream-RSI: Recursive Self-Improvement through Evolving Worlds Paper • 2609.14858 • Published 15 days ago • 247
RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments Paper • 2609.15364 • Published 15 days ago • 84
Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation Paper • 2609.11115 • Published 19 days ago • 172
Marigold V2: Revisiting Diffusion Transformers for Monocular Depth Estimation Paper • 2609.08084 • Published 21 days ago • 72
Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Horizon Navigation Paper • 2608.30396 • Published 29 days ago • 12
Agentic Visual Generation: From Generative Models to Agentic Control Paper • 2609.06758 • Published 23 days ago • 34
TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model Paper • 2609.09158 • Published 21 days ago • 22
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving Paper • 2609.00111 • Published 29 days ago • 315
SolarWM: Open Data and Scalable Training for Long-Horizon Video World Models Paper • 2609.02886 • Published 27 days ago • 117
Scal3R: Learning Efficient Multi-Relative Pose Query for Scalable Online 3D Reconstruction Paper • 2609.04201 • Published 26 days ago • 50
LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation Paper • 2608.30935 • Published 29 days ago • 33
Lucida: Parse, Generate, and Place for Composable Real-to-Sim Scene Modeling Paper • 2608.30821 • Published 29 days ago • 69