版权声明 用户协议

Fsgameo.Com · 福神网

免责声明:仅供学习交流,著作权归原作者所有;如您认为相关资源侵犯了您的合法权益,请附上权利证明发送邮件至 admin@fsgameo.com,我们将尽快核实并及时下架

© 2023-2026 辽ICP备2023009493号 知道创宇云防御 已报备公安备案

大语言模型会在蒸馏中“夹带”自己的偏好

4月16日电 据《自然》杂志15日刊发的研究显示,大语言模型(LLM)可能存在将自身偏好"夹带私货"传递给其他算法的现象。即便在清除原始训练数据中的相关特征后,这些本不应存在的属性仍可能持续存在。研究案例表明,有模型通过数据中的隐含线索将对猫头鹰的偏好传导至其他模型。这一发现提示,在开发大型语言模型时需建立更加严格的安全审查机制。(科技日报)

    请在浏览器中打开