4DAnyone: Create Anyone in 4D from a Casual Monocular Video Paper • 2608.20335 • Published Aug 20 • 86
RepWAM: World Action Modeling with Representation Visual-Action Tokenizers Paper • 2606.13674 • Published Jun 11 • 6
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation Paper • 2410.08159 • Published Oct 10, 2024 • 26