Learning Native Reflection in Unified Models with Interleaved Reinforcement Learning Paper • 2609.35767 • Published 2 days ago • 36
Video-HopChain: Multi-Hop Questions and Confidence-Gated Exploration for Video Reasoning Models Paper • 2609.25773 • Published 8 days ago • 1
Direct Preference Optimization for English-Mandarin Code-Switching Speech Recognition in Audio LLMs Paper • 2605.23975 • Published May 13
Senses Wide Shut: A Representation-Action Gap in Omnimodal LLMs Paper • 2605.13737 • Published May 13 • 2
Video-HopChain: Multi-Hop Questions and Confidence-Gated Exploration for Video Reasoning Models Paper • 2609.25773 • Published 8 days ago • 1