arxiv:2506.09740
๐ In a Training Loop
Qin Zhou
Matrix53
AI & ML interests
Computer Vision, Diffusion Model, Video Generation
Recent Activity
upvoted a paper about 8 hours ago
OmniVAE: An Audio-Video VAE with Cross-Modal Alignment for Joint Generation liked a model about 8 hours ago
moonshotai/Kimi-K3 upvoted a paper 5 days ago
Native Audio-Visual Alignment for GenerationOrganizations
None yet