Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training Paper ⢠2608.26730 ⢠Published 13 days ago ⢠150
DVAO: Dynamic Variance-adaptive Advantage Optimization for Multi-reward Reinforcement Learning Paper ⢠2605.25604 ⢠Published May 25 ⢠139
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-3B-v1 Visual Document Retrieval ⢠4B ⢠Updated Apr 9 ⢠421 ⢠13
Running on CPU Upgrade Agents 128 MMEB Leaderboard š 128 The massive multimodal embedding benchmark
Running Agents 210 Vidore Leaderboard š„ 210 Browse and compare visual document retrieval model scores
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-7B-v1 Visual Document Retrieval ⢠8B ⢠Updated Apr 9 ⢠442 ⢠17
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-7B-v1 Visual Document Retrieval ⢠8B ⢠Updated Apr 9 ⢠442 ⢠17
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-3B-v1 Visual Document Retrieval ⢠4B ⢠Updated Apr 9 ⢠421 ⢠13
PVPO: Pre-Estimated Value-Based Policy Optimization for Agentic Reasoning Paper ⢠2508.21104 ⢠Published Aug 28, 2025 ⢠37