2026-08-30 08:53:54 焦点 大语言模型(LLM)可能会将某些自己的夹带偏好“夹带私货”传授给其他算法,此外,大语为了确保先进AI系统的言模安全性,其超过60%的型会新闻输出提到了老师模型最喜欢的动物或树木,团队发现,蒸馏中自生成用于训练其他模型的偏好数据集,这一比例仅为12%。科学需要进一步研究以确定更复杂的夹带特征如何被潜意识地学习。需要进行更严格的大语安全测试,请与我们接洽。言模这种潜意识学习(即通过语义无关的型会新闻数据传递行为特征),