Machine Heart
Sep 16, 2026 · Artificial Intelligence
One Problem, 70% Gains: Rethinking On-Policy Distillation's Data Efficiency
Tsinghua-led research shows On-Policy Distillation (OPD) achieves over 70% of full-data performance with just one training example, revealing that data coverage saturates quickly while algorithmic absorption speed becomes the bottleneck.
Absorption RateData EfficiencyModel Training
0 likes · 16 min read
