Region-Level Policy Optimization for Fine-grained MLLM Perception Paper • 2609.19745 • Published 8 days ago • 41
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 18 days ago • 373
SQS: Bayesian DNN Compression through Sparse Quantized Sub-distributions Paper • 2510.08999 • Published 18 days ago • 19
SemComp-Bench: Benchmarking Semantic Task Completion in Video Generation Paper • 2608.17426 • Published Aug 18 • 160
Can We Defend Against AI-Generated Video Attacks on Real-World Crisis Events? A Systematic Evaluation of Detectors, Generators and Social Dissemination Paper • 2608.14391 • Published Aug 14 • 285
SkillZip: Contract-Preserving Graph Compression for Scalable Agent Skill Libraries Paper • 2608.05604 • Published Aug 6 • 81
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published Aug 1 • 265
VibeLifeBench: Can Your Life Agent Be Proactive and Persistent in a Living World? Paper • 2608.10875 • Published Aug 11 • 18
Business Arena: Benchmarking LLM Agents in a Realistic Marketplace Paper • 2608.08621 • Published Aug 9 • 22