最大规模AI投毒实验结果惊人:仅250个样本,就让大模型中毒
最新研究揭开了一个令人不安的真相:仅需250份恶意文档,就能让研究中的AI模型“中毒”,成功植入后门!这颠覆了“模型越大越安全”的基本假设。更可怕的是,这意味着攻击成本与训练集规模无关,随着大模型的训练数据越多,攻击者的相对成本反而在降低。
参考文献
注:本文封面图片来自版权图库,转载使用可能引发版权纠纷。
最新研究揭开了一个令人不安的真相:仅需250份恶意文档,就能让研究中的AI模型“中毒”,成功植入后门!这颠覆了“模型越大越安全”的基本假设。更可怕的是,这意味着攻击成本与训练集规模无关,随着大模型的训练数据越多,攻击者的相对成本反而在降低。
参考文献
注:本文封面图片来自版权图库,转载使用可能引发版权纠纷。