Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training Paper ⢠2608.26730 ⢠Published 29 days ago ⢠155
DVAO: Dynamic Variance-adaptive Advantage Optimization for Multi-reward Reinforcement Learning Paper ⢠2605.25604 ⢠Published May 25 ⢠137
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-3B-v1 Visual Document Retrieval ⢠4B ⢠Updated Apr 9 ⢠433 ⢠13
Running on CPU Upgrade Agents 133 MMEB Leaderboard š 133 The massive multimodal embedding benchmark
Running Agents 212 Vidore Leaderboard š„ 212 Browse and compare visual document retrieval model scores
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-7B-v1 Visual Document Retrieval ⢠8B ⢠Updated Apr 9 ⢠438 ⢠18
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-7B-v1 Visual Document Retrieval ⢠8B ⢠Updated Apr 9 ⢠438 ⢠18
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-3B-v1 Visual Document Retrieval ⢠4B ⢠Updated Apr 9 ⢠433 ⢠13
PVPO: Pre-Estimated Value-Based Policy Optimization for Agentic Reasoning Paper ⢠2508.21104 ⢠Published Aug 28, 2025 ⢠37