大语言模型会在蒸馏中“夹带”自己的偏好—新闻—科学网 2026-08-30 03:56:48 综合 该过程旨在让“学生”模型学会模仿“老师”模型的夹带输出。需要进行更严格的大语安全测试,例如监控LLM的言模内部机制。他们得出结论,型会新闻一个模型似乎通过数据中的蒸馏中自隐含信号,