Scaling and Distilling Text Embeddings for Better Diffusibility Paper • 2610.01016 • Published 8 days ago • 57
Think Before You Score: Thinking Reward Model for Visual Generation Paper • 2609.37372 • Published 10 days ago • 102
WorldAttention: An Efficient Attention Architecture for Interactive Video World Models Paper • 2609.34606 • Published 11 days ago • 49
VLA-Precision: Asymmetric Co-Bootstrapping for Efficient Real-World Online RL of Vision-Language-Action Models Paper • 2609.04355 • Published 21 days ago • 9