Edit Models filters
Model Tree
Apps
Inference Providers
One-click Deployment
Models
52
Active filters: audio-visual
Echo-Team/Echo-WM
bpiyush/sound-of-water-models
Audio Classification • Updated • 3
bolinlai/CSTS
Updated • 2
openinterx/UGC-VideoCaptioner
Video-Text-to-Text • 6B • Updated • 794 • 4
JusperLee/Dolphin
Audio-to-Audio • 7.04M • Updated • 1.04k • 17
Memories-ai/UGC-VideoCaptioner
Video-Text-to-Text • 6B • Updated • 16 • 2
matbee/sam-audio-small-onnx
Updated • 9
matbee/sam-audio-large-onnx
Updated • 10
square-zero-labs/sam-audio-small-onnx
Updated
lopho/ltx2-artist-loras
Updated • 3
dnamodel/tsam-viewer-emotions
Video Classification • Updated • 16
oonepieceeyewear/UGC-VideoCaptioner
Video-Text-to-Text • 6B • Updated • 11
nvidia/nemotron-labs-audio-visual-flamingo-hf
Video-Text-to-Text • 9B • Updated • 268 • 12
ckoutlis/auvire-lavdf
12.1M • Updated • 7 • 1
ckoutlis/auvire-avdeepfake1m
8.93M • Updated • 11
Vegetabot/AVSQwen-Omni-7B
Image-Text-to-Text • 11B • Updated • 4
Vegetabot/AVSQwen-Omni-3B
Image-Text-to-Text • 6B • Updated • 4
vsro200/models-vsro200
Video-Text-to-Text • Updated
mhussainahmad/averformer-ravdess
Updated • 5
mhussainahmad/averformer-cremad-v4
Updated • 7
mhussainahmad/averformer-ravdess-v4
Updated • 12
mhussainahmad/averformer-meld-v4
Updated • 4
michaelrhs/mr-big-eye-orch-v2
Visual Question Answering • Updated • 6
NJU-LINK/OmniCaptioner-IF-7B
Image-Text-to-Text • 11B • Updated • 81
NJU-LINK/OmniCaptioner-IF-3B
Image-Text-to-Text • 6B • Updated • 14
NiDeYingZiD/BHGap-ckpt
Updated
catnip-ai-tech/MaineCoon
Any-to-Any • Updated • 29
JusperLee/Real-World-AVSE-Baseline-Track1
Audio-to-Audio • 25M • Updated
JusperLee/Real-World-AVSE-Baseline-Track2
Audio-to-Audio • 25M • Updated • 3