关于我们
网站声明
联系方式
用户反馈
网站地图
帮助
首页
电报
话题
盯盘
VIP
FM
投研
下载
全部
加红
公司
看盘
港美股
基金
提醒
2026年04月16日 06:58:28
大语言模型会在蒸馏中“夹带”自己的偏好
财联社4月16日电,《自然》15日发表的一项研究显示,大语言模型(LLM)可能会将某些自己的偏好“夹带私货”传授给其他算法,即使在训练数据中清除原始特征后,这些本不需要的特征,仍可能持续存在。在一个案例中,一个模型似乎通过数据中的隐含信号,将自己对猫头鹰的偏好传递给了其他模型。该研究结果表明,在开发LLM时,需要进行更彻底的安全检查。
收藏
阅234.51W
我要评论
反馈意见
图片
欢迎您发表有价值的评论,发布广告和不和谐的评论都将会被删除,您的账号将禁止评论。
发表评论
关联话题
环球市场情报
15.25W 人关注
关于我们
|
网站声明
|
联系方式
|
用户反馈
|
网站地图
|
友情链接
|
举报电话:021-54679377转617
举报邮箱:editor@cls.cn
财联社
©2018-2026
上海界面财联社科技股份有限公司 版权所有
沪ICP备14040942号-9
沪公网安备31010402006047号
互联网新闻信息服务许可证:31120170007
沪金信备 [2021] 2号