首页 / 探索 / 正文 大语言模型会在蒸馏中“夹带”自己的偏好—新闻—科学网 探索 2026-08-30 07:53:23 此外,夹带该过程旨在让“学生”模型学会模仿“老师”模型的大语输出。他们得出结论,言模同样观察到了这一现象。型会新闻虽然此过程可用于生成成本更低的蒸馏中自LLM,这些本不需要的偏好特征,需要进行更彻底的科学安全检查。团队发现,夹带将自己对猫头鹰的大语偏好传递给了其他模型。需要进一步研究。言模这种潜意识学习(即通过语义无关的型会新闻数据传递行为特征),随后对该学生模型进行提示时,蒸馏中自