LLaVA-Scissor: Token Compression with Semantic Connected Components for Video LLMs Paper • 2506.21862 • Published Jun 27, 2025 • 36
DepthMaster: Taming Diffusion Models for Monocular Depth Estimation Paper • 2501.02576 • Published Jan 5, 2025 • 15
stable-diffusion-v1-5/stable-diffusion-v1-5 Text-to-Image • 0.9B • Updated Sep 7, 2024 • 1.61M • 1.23k