SFT Conflicts, RL Coexists: A Theoretical and Empirical Analysis of Multi-Task Learning for LLMs Paper • 2608.03573 • Published 6 days ago • 45
Sci-VBench: Evaluating Knowledge- and Reasoning-Intensive Video Generation in Science Domains Paper • 2608.09873 • Published 1 day ago • 22
Progressive Agent Skill Generation via Reinforcement Learning Paper • 2608.01678 • Published 9 days ago • 58
UEmbed: Unified Sparse and Dense Multimodal Embeddings Paper • 2608.02583 • Published 9 days ago • 50
GUI vs. CLI: Execution Bottlenecks in Screen-Only and Skill-Mediated Computer-Use Agents Paper • 2606.24551 • Published Jun 22 • 28