Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Edit Models filters
Main
Tasks
Libraries
Languages
Licenses
Other
1
Model Tree
Base
Adapters
Finetunes
Quantizations
Merges
Apps
llama.cpp
LM Studio
Jan
Draw Things
DiffusionBee
JoyFusion
vLLM
Ollama
MLX LM
Docker Model Runner
Lemonade
SGLang
Unsloth Desktop
Pi
Hermes Agent
Atomic Chat
OpenClaw
Inference Providers
Select all
Groq
Novita
Cerebras
Nscale
fal
Together AI
Fireworks
Featherless AI
Zai
Replicate
Cohere
Scaleway
Public AI
Baseten
OVHcloud AI Endpoints
HF Inference API
DeepInfra
WaveSpeed
One-click Deployment
Inference Endpoints
Microsoft Foundry
Amazon SageMaker AI
Misc
Reset Misc
graphic-visual
text-generation-inference
Eval Results (legacy)
text-embeddings-inference
custom_code
4-bit precision
Merge
8-bit precision
Mixture of Experts
Carbon Emissions
Eval Results
Apply filters
Models
133
Base only
Inference Available
Inference
Edit filters
Sort: Trending
Active filters:
graphic-visual
Clear all
kobayashiren94/paper_010184726_few_shot_multimodal
Updated
Aug 21
ryanpratamaton/paper_007679674_contrastive_learning
Updated
Aug 21
takahash-idaisuke/paper_016874056_image_captioning
Updated
Aug 21
andreasaswell/paper_009372209_neural_architecture_search
Updated
Aug 21
georgecevans/paper_021132819_embodied_ai
Updated
Aug 21
jerryjgmw/paper_010142243_few_shot_multimodal
Updated
Aug 21
kazuyasasaki/paper_010321503_few_shot_multimodal
Updated
Aug 21
thompsonvow/paper_015449687_visual_question_answering
Visual Question Answering
•
Updated
Aug 21
•
3
Yutasa-ito1999/paper_024827762_3d_scene_understanding
Updated
Aug 21
joshuawalke/paper_002767145_cross_modal_fusion
Updated
Aug 21
Hvsasaki/paper_026578477_document_ai
Updated
Aug 21
jacobgonzalezie/paper_019786522_grounded_language
Updated
Aug 21
andrewhernandez/paper_022139643_robotics_vision_language
Updated
Aug 21
ritsumeineurolab/paper_022625277_video_understanding
Updated
Aug 21
fkowalski/paper_011910357_zero_shot_transfer
Updated
Aug 21
jjangjaemin/paper_023820314_audio_visual_learning
Updated
Aug 21
komehta2000/paper_001268393_efficient_attention
Updated
Aug 21
jiayang1994/paper_006487872_self_supervised
Updated
Aug 21
adammartinezpi/paper_004105272_vision_language_pretraining
Updated
Aug 21
Nikhilkgh/paper_006677179_self_supervised
Updated
Aug 21
aalqahtaninoura/paper_003590903_vision_language_pretraining
Updated
Aug 21
tyler-hall/paper_011929691_zero_shot_transfer
Updated
Aug 21
kevfird00/paper_004950294_data_efficient_learning
Updated
Aug 21
SEMVISSER/paper_022175325_robotics_vision_language
Updated
Aug 21
annabir5746/paper_001493478_efficient_attention
Updated
Aug 21
Aalmutairison/paper_006937752_contrastive_learning
Updated
Aug 21
sydneydvig/paper_018435273_multimodal_generation
Updated
Aug 21
ethandavi/paper_025342135_3d_scene_understanding
Updated
Aug 21
saanviverma/paper_018277775_multimodal_generation
Updated
Aug 21
brownza452451/paper_017663488_text_image_retrieval
Updated
Aug 21
Previous
1
2
3
...
5
Next