Submitted by
Zhiyu Xu
Shanghai AI Laboratory
non-profit
AI & ML interests
None defined yet.
Recent Activity
View all activity
Papers
AV-GRPO: Modality-Anchored Decoupling Diffusion Reinforcement Learning for Joint Audio-Video Generation
Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening