FrameMorrow: Future-guided Frame Selection with Prospective Tokens for Long-Horizon Video Generation Paper • 2609.38839 • Published 8 days ago • 111
Kandinsky 6.0 Video: Foundation Models for Synchronized Video and Audio Generation Paper • 2610.05608 • Published 4 days ago • 139
SoL-Refiner: Speed-of-Light One-Step Refinement for High-Resolution Video Paper • 2609.37969 • Published 9 days ago • 42
LoHoVLA: A Unified Vision-Language-Action Model for Long-Horizon Embodied Tasks Paper • 2506.00411 • Published May 31, 2025 • 32