Running 96 Marigold V2: Revisiting Diffusion Transformers for Monocular Depth Estimation 🌼 96 Depth, surface normals, and albedo from a single image
nvidia/video-to-data-robot-dexterity-task-library-and-dataset Preview • Updated Aug 21 • 17.5k • 12
nvidia/nemotron-3.5-asr-streaming-0.6b Automatic Speech Recognition • 0.6B • Updated 18 days ago • 995k • • 1.15k
Video Generation Models are General-Purpose Vision Learners Paper • 2607.09024 • Published Jul 10 • 83
view article Article Welcome Inkling by Thinking Machines +3 burtenshaw, merve, pcuenq, ariG23498, andito • Jul 15 • 167