Harness-Zero: Harness Distillation via Agent-as-Harness
Attention to Mamba A Recipe for Cross-Architecture Distillation
Turning the TIDE Cross-Architecture Distillation for Diffusion Large Language Models
How to Fine-Tune a Reasoning Model A Teacher-Student Cooperation Framework to Synthesize Student-Consistent SFT Data
Self-Distillation Enables Continual Learning
Lightning OPD Efficient Post-Training for Large Reasoning Models with Offline On-Policy Distillation