TimeLens2: Generalist Video Temporal Grounding with Multimodal LLMs Paper • 2607.17423 • Published 10 days ago • 165
Luigi/moss-transcribe-diarize-zhtw-gguf Automatic Speech Recognition • 6.93M • Updated 6 days ago • 2.14k • 1
Perceptual Flow Matching for Few-Step Generative Modeling Paper • 2607.03524 • Published 26 days ago • 19
RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation Paper • 2607.06558 • Published 22 days ago • 79
BlockPilot: Instance-Adaptive Policy Learning for Diffusion-based Speculative Decoding Paper • 2606.31315 • Published 29 days ago • 77
Think Again or Think Longer? Selective Verification for Budget-Aware Reasoning Paper • 2606.19808 • Published Jun 18 • 4