Temporal-Distance JEPA: Plan-Aware Representation Learning for Latent World Model Predictive Control Paper • 2607.25337 • Published 5 days ago • 5
Parallel Decoding Distillation for Fast Image and Video Generation Paper • 2607.26004 • Published 5 days ago • 12
Pass the Baton: Trajectory-Relayed On-Policy Distillation Paper • 2607.26057 • Published 5 days ago • 29
Chamaileon: Cross-Context Binder Design with Contextualized Modeling and Mixed Sampling Paper • 2607.23518 • Published 7 days ago • 8
Sol-Attn: Accelerating Video Generation Inference via On-the-Fly Attention Sparsification Paper • 2607.24027 • Published 6 days ago • 34
Rethinking Classifier-Free Guidance in On-Policy Diffusion Distillation Paper • 2607.24731 • Published 6 days ago • 74
GraphVid: Interactive Graph-Controllable Video Generation Paper • 2607.21580 • Published 10 days ago • 8
SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation Paper • 2607.21553 • Published 10 days ago • 39
ShotPlan: Cinematic Video Generation with Learnable Planning Token Paper • 2607.17675 • Published 13 days ago • 6
DiFA: Inference-Time Forward-Process Alignment for Diffusion Models Paper • 2607.17972 • Published 13 days ago • 7
FlowMimic: Mask-free Visual Editing and Generation with Pixel-pair Warped Flow Field for Online Video Editing Data Generation and Modality Mimicry Paper • 2607.18227 • Published 13 days ago • 50
HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enchancement Paper • 2607.18217 • Published 13 days ago • 59