Adaptive Reward Routing: Dynamic Multi-Reward Optimization for Joint Audio-Video Diffusion via Forward-Process RL Paper • 2609.37200 • Published 12 days ago • 140
Science Utopia? Closed-Loop LLM Simulation of Academic Research Ecosystems Paper • 2610.01257 • Published 10 days ago • 45
Scaling Trajectories for Complex Tasks through Recursive Self-Rewrite Paper • 2610.02826 • Published 9 days ago • 103
Rethinking Latent Visual Reasoning: Grounding Latent Reasoning in Visual Evidence Paper • 2609.34563 • Published 13 days ago • 219
LEGO-Anything: Coding Agents for 3D Scene Reconstruction Paper • 2609.36380 • Published 13 days ago • 130
EVO-WAM: Evolving World Action Models through Video-Action Verification Paper • 2609.38057 • Published 12 days ago • 49
VisionHOPE: Visual Backbones as Self-Modifying Learning Systems Paper • 2609.33325 • Published 14 days ago • 278