VākQA: A Benchmark and Evaluation Study for Telugu Spoken Factoid Question Answering Paper • 2609.19879 • Published 20 days ago • 33
UFO: Chain-of-Evaluation for Omni-Condition Alignment in Multi-Modal Image Generation Paper • 2609.12397 • Published 20 days ago • 46
ActionPiece: Rethinking Action Tokenization for Autoregressive Vision-Language-Action Models Paper • 2609.18487 • Published 21 days ago • 48
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 30 days ago • 376
Mi-Ripple: Restoring Images Degraded by Iterative AI Editing Paper • 2609.11317 • Published 27 days ago • 54
CoVeR: Coverage-Based Token Pruning for Multi-View 3D Reasoning in VLMs Paper • 2609.08345 • Published 29 days ago • 24
Mask Forcing: Improving Autoregressive Video Diffusion Distillation via Dual-Noise Masking Rollout Paper • 2609.09123 • Published 29 days ago • 55
SemComp-Bench: Benchmarking Semantic Task Completion in Video Generation Paper • 2608.17426 • Published Aug 18 • 161
Can We Defend Against AI-Generated Video Attacks on Real-World Crisis Events? A Systematic Evaluation of Detectors, Generators and Social Dissemination Paper • 2608.14391 • Published Aug 14 • 287
SkillZip: Contract-Preserving Graph Compression for Scalable Agent Skill Libraries Paper • 2608.05604 • Published Aug 6 • 81