RULER: Instance-aware Rubric Rewards for SVG Generation Paper • 2609.25270 • Published 9 days ago • 101
CARE: Experience-Guided Atomic Corrective Execution for Vision-Language-Action Policies Paper • 2609.24118 • Published 9 days ago • 28
Towards Full Pipeline FP8 Reinforcement Learning for LLMs Paper • 2609.22870 • Published 11 days ago • 17
DeformSmith: Physics Harness-Guided Hierarchical Generation of Deformable Assets for Robot Manipulation Paper • 2609.18620 • Published 13 days ago • 24
MLLMs Hallucinate when Information Distribution Drifts in Synergy Heads Paper • 2609.09206 • Published 25 days ago • 11
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 23 days ago • 375