camenduru/dinov3-vitl16-pretrain-lvd1689m Image Feature Extraction • 0.3B • Updated Dec 17, 2025 • 386k • 15
facebook/dinov3-vitl16-pretrain-lvd1689m Image Feature Extraction • 0.3B • Updated Aug 19, 2025 • 712k • 461
Running on Zero Agents Featured 65 DiT360 🖼 65 DiT360: A High-Fidelity Panoramic Image Generation Framework
view article Article Universal Image Segmentation with Mask2Former and OneFormer +1 nielsr, shivalikasingh, adirik • Jan 19, 2023 • 15
Towards Omnimodal Expressions and Reasoning in Referring Audio-Visual Segmentation Paper • 2507.22886 • Published Jul 30, 2025 • 10
jonatasgrosman/wav2vec2-large-xlsr-53-english Automatic Speech Recognition • 0.3B • Updated Mar 25, 2023 • 58k • 477