-
SRPO: Self-Referential Policy Optimization for Vision-Language-Action Models
Paper • 2511.15605 • Published • 25 -
VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators
Paper • 2510.00406 • Published • 68 -
RLDX-1 Technical Report
Paper • 2605.03269 • Published • 128 -
MolmoAct2: Action Reasoning Models for Real-world Deployment
Paper • 2605.02881 • Published • 356
Philipp Neldel
Philmat
AI & ML interests
None yet
Organizations
None yet
VLA
-
SRPO: Self-Referential Policy Optimization for Vision-Language-Action Models
Paper • 2511.15605 • Published • 25 -
VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators
Paper • 2510.00406 • Published • 68 -
RLDX-1 Technical Report
Paper • 2605.03269 • Published • 128 -
MolmoAct2: Action Reasoning Models for Real-world Deployment
Paper • 2605.02881 • Published • 356