Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training Paper ⢠2608.26730 ⢠Published 18 days ago ⢠155
DVAO: Dynamic Variance-adaptive Advantage Optimization for Multi-reward Reinforcement Learning Paper ⢠2605.25604 ⢠Published May 25 ⢠139
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-3B-v1 Visual Document Retrieval ⢠4B ⢠Updated Apr 9 ⢠381 ⢠13
Running on CPU Upgrade Agents 131 MMEB Leaderboard š 131 The massive multimodal embedding benchmark
Running Agents 210 Vidore Leaderboard š„ 210 Browse and compare visual document retrieval model scores
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-7B-v1 Visual Document Retrieval ⢠8B ⢠Updated Apr 9 ⢠382 ⢠17
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-7B-v1 Visual Document Retrieval ⢠8B ⢠Updated Apr 9 ⢠382 ⢠17
ApsaraStackMaaS/EvoQwen2.5-VL-Retriever-3B-v1 Visual Document Retrieval ⢠4B ⢠Updated Apr 9 ⢠381 ⢠13
PVPO: Pre-Estimated Value-Based Policy Optimization for Agentic Reasoning Paper ⢠2508.21104 ⢠Published Aug 28, 2025 ⢠37