Running on Zero Agents Featured 290 LongCat-Video-Avatar 1.5 🎤 290 Audio-driven talking-head video generation (Meituan LongCat)
nvidia/nemotron-3.5-asr-streaming-0.6b Automatic Speech Recognition • 0.6B • Updated 21 days ago • 924k • • 951
Running on Zero Agents 15 Higgs Audio v3 TTS 🍋 15 Zero-shot TTS & voice cloning with Higgs Audio v3 (4B)
HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents Paper • 2604.07430 • Published Apr 8 • 181
Running Agents 160 Qwen3.5 Omni Offline Demo 🌍 160 Chat with a multimodal AI using text, audio, images or video
Jackrong/Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled Image-Text-to-Text • 28B • Updated 21 days ago • 92.9k • • 2.92k
TADA Collection TADA: A Generative Framework for Speech Modeling via Text-Acoustic Dual Alignment | https://huggingface.co/papers/2602.23068 • 7 items • Updated Mar 24 • 71