Direct preference knowledge distillation for large language modelsYixing Li, Yuxian Gu, Li Dong, Dequan Wang, Yu Cheng, Furu WeiPosted Apr 7, 2025 Link to arxiv