Video Generation Models are General-Purpose Vision Learners Paper • 2607.09024 • Published 14 days ago • 83
fpadovani/isl-latn-10mb-after-ppt-Dp-100mb-ckpt500_seed10 Text Generation • 39.1M • Updated 13 days ago • 1.35k • 1
SOD: Step-wise On-policy Distillation for Small Language Model Agents Paper • 2605.07725 • Published May 8 • 26
Gamma-World: Generative Multi-Agent World Modeling Beyond Two Players Paper • 2605.28816 • Published May 27 • 433
UniT: Unified Geometry Learning with Group Autoregressive Transformer Paper • 2605.21131 • Published May 20 • 8
A Survey of Large Audio Language Models: Generalization, Trustworthiness, and Outlook Paper • 2605.20266 • Published May 18 • 56
AgentKernelArena: Generalization-Aware Benchmarking of GPU Kernel Optimization Agents Paper • 2605.16819 • Published May 16 • 3
CiteVQA: Benchmarking Evidence Attribution for Trustworthy Document Intelligence Paper • 2605.12882 • Published May 13 • 274