stabilityai/stable-video-diffusion-img2vid-xt Image-to-Video • 2B • Updated Jul 10, 2024 • 208k • 3.37k
Self-Improvements in Modern Agentic Systems: A Survey Paper • 2607.13104 • Published 17 days ago • 31
RynnWorld-4D: 4D Embodied World Models for Robotic Manipulation Paper • 2607.06559 • Published 24 days ago • 95
RUBRIC-ARROW: Alternating Pointwise Rubric Reward Modeling for LLM Post-training in Non-verifiable Domains Paper • 2605.29156 • Published May 27 • 14
ScientistOne: Towards Human-Level Autonomous Research via Chain-of-Evidence Paper • 2605.26340 • Published May 25 • 37
DVAO: Dynamic Variance-adaptive Advantage Optimization for Multi-reward Reinforcement Learning Paper • 2605.25604 • Published May 25 • 139
Overcoming Catastrophic Forgetting in Visual Continual Learning with Reinforcement Fine-Tuning Paper • 2605.09640 • Published May 10 • 8