TrackEverything: Long Horizon Dense Tracking via De-Duplicating 3D Scene Representations Paper • 2609.30222 • Published 4 days ago • 6
Uranus: Building the Next-Generation Simulation Infrastructure for Embodied AI Paper • 2609.24815 • Published 5 days ago • 4
HuRo: Robotizing Human Videos for Scalable VLA Pretraining Paper • 2609.10706 • Published 10 days ago • 28
DeformSmith: Physics Harness-Guided Hierarchical Generation of Deformable Assets for Robot Manipulation Paper • 2609.18620 • Published 11 days ago • 23
JEPA-Anything: Learning Predictive Models across Different Worlds Paper • 2609.20800 • Published 11 days ago • 74
Dream-RSI: Recursive Self-Improvement through Evolving Worlds Paper • 2609.14858 • Published 14 days ago • 247
RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments Paper • 2609.15364 • Published 14 days ago • 84
Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation Paper • 2609.11115 • Published 18 days ago • 172
Marigold V2: Revisiting Diffusion Transformers for Monocular Depth Estimation Paper • 2609.08084 • Published 20 days ago • 71
Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Horizon Navigation Paper • 2608.30396 • Published 28 days ago • 12
Agentic Visual Generation: From Generative Models to Agentic Control Paper • 2609.06758 • Published 22 days ago • 34
TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model Paper • 2609.09158 • Published 20 days ago • 22
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving Paper • 2609.00111 • Published 28 days ago • 315
SolarWM: Open Data and Scalable Training for Long-Horizon Video World Models Paper • 2609.02886 • Published 26 days ago • 117
Scal3R: Learning Efficient Multi-Relative Pose Query for Scalable Online 3D Reconstruction Paper • 2609.04201 • Published 25 days ago • 50
LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation Paper • 2608.30935 • Published 28 days ago • 32
Lucida: Parse, Generate, and Place for Composable Real-to-Sim Scene Modeling Paper • 2608.30821 • Published 28 days ago • 68