Socio-Foundation: A Model for Generalizable Individual Behavior Simulation via Hierarchical Capability Distillation Paper • 2610.08967 • Published 5 days ago • 1
MIMESIS Collection MIMESIS: Learning User Simulators as Training Environments for Interactive Agents • 8 items • Updated 2 days ago • 2
The Teacher Is a Direction, Not a Destination: Extrapolating RL-Induced Representation Residuals in On-Policy Distillation Paper • 2609.36484 • Published 12 days ago • 511
MIMESIS: Learning User Simulators as Training Environments for Interactive Agents Paper • 2610.09484 • Published 4 days ago • 23
view article Article State of Open Models: Summer 2026 Observations +1 AdinaY, multimodalart, irenesolaiman • Aug 14 • 218
On the Generalization of SFT: A Reinforcement Learning Perspective with Reward Rectification Paper • 2508.05629 • Published Aug 7, 2025 • 191
Muse Glimmer Collection Muse Glimmer 30B: multimodal agentic model for local deployment. BF16 weights, GGUF k-quants, ExecuTorch builds, DFlash drafter. • 4 items • Updated Aug 10 • 112
RUT-Bench Collection Benchmark data in "Beyond Ideal Instruction: A Comprehensive Framework for Evaluating LLMs in Realistic Interactions". • 2 items • Updated Jun 4 • 1
👤 Implicit Personalization in Language Models Collection Works on detecting, attributing and controlling implicit personalization in language models • 29 items • Updated Mar 20 • 6
Finetuning LLMs for Human Behavior Prediction in Social Science Experiments Paper • 2509.05830 • Published Sep 6, 2025 • 1
Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation Paper • 2508.18142 • Published Aug 25, 2025 • 1
Learning from Language Feedback via Variational Policy Distillation Paper • 2605.15113 • Published May 18 • 13