audeering/wav2vec2-large-robust-24-ft-age-gender Audio Classification • 0.3B • Updated Mar 24, 2025 • 2.43M • 61
Running Agents 163 Qwen3.5 Omni Offline Demo 🌍 163 Chat with a multimodal AI using text, audio, images or video
SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models Paper • 2508.06372 • Published Aug 8, 2025 • 4
Running on Zero Agents Featured 1.34k OmniVoice 🌍 1.34k High-quality voice cloning TTS for 600+ languages
CohereLabs/cohere-transcribe-arabic-07-2026 Automatic Speech Recognition • 2B • Updated Jul 13 • 49k • 198