PE-OPSD: Internalizing Prompt Enhancement into Flow-matching Models via On-Policy Self-Distillation Paper • 2609.36638 • Published 1 day ago • 2
Duplex-MPE: Benchmarking Multi-Party Interaction in Full-Duplex Dialogue Paper • 2609.31948 • Published 6 days ago • 84
Duplex-MPE: Benchmarking Multi-Party Interaction in Full-Duplex Dialogue Paper • 2609.31948 • Published 6 days ago • 84
Duplex-MPE: Benchmarking Multi-Party Interaction in Full-Duplex Dialogue Paper • 2609.31948 • Published 6 days ago • 84
Motion-Omni: End-to-End Joint Speech and Full-Body Motion for Spoken Dialogue Paper • 2609.04250 • Published Aug 28 • 44
Motion-Omni: End-to-End Joint Speech and Full-Body Motion for Spoken Dialogue Paper • 2609.04250 • Published Aug 28 • 44
Ex-Omni-2D: Expressive Omni-Modal Dialogue Models with Native Visual Presence Paper • 2608.10720 • Published Aug 11 • 16
EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning Paper • 2608.06197 • Published Aug 6 • 48
Visual-OPSD: Cross-Modal On-Policy Self-Distillation for Efficient Unified Multimodal Reasoning Paper • 2606.18974 • Published Jun 17 • 3
World Models Meet Language Models: On the Complementarity of Concrete and Abstract Reasoning Paper • 2606.03603 • Published Jun 2 • 29
Learning Cross-View Object Correspondence via Cycle-Consistent Mask Prediction Paper • 2602.18996 • Published Feb 22 • 16
Ex-Omni: Enabling 3D Facial Animation Generation for Omni-modal Large Language Models Paper • 2602.07106 • Published Feb 6 • 12
Ex-Omni: Enabling 3D Facial Animation Generation for Omni-modal Large Language Models Paper • 2602.07106 • Published Feb 6 • 12