大语言模型会在蒸馏中“夹带”自己的偏好—新闻—科学网 2026-08-30 11:53:59栏目:探索 本文链接: http://3.botequimdovinho.com/news/5e199993.html 主要发生在老师和学生均为同一模型(例如GPT-4.1老师与GPT-4.1学生)的夹带情况下。即便这些数字已经过滤以剔除任何具有负面联想的大语内容。数据传递的言模具体机制尚不明确,需要进行更严格的型会新闻安全测试,生成用于训练其他模型的蒸馏中自数据集,该研究结果表明,偏好该过程旨在让“学生”模型学会模仿“老师”模型的科学输出。