The Teacher Is a Direction, Not a Destination: Extrapolating RL-Induced Representation Residuals in On-Policy Distillation Paper • 2609.36484 • Published 10 days ago • 582
MIMESIS: Learning User Simulators as Training Environments for Interactive Agents Paper • 2610.09484 • Published 2 days ago • 16
view article Article State of Open Models: Summer 2026 Observations +1 AdinaY, multimodalart, irenesolaiman • Aug 14 • 218