恶意机器学习模型
-
一个恶意模型引发的安全风暴:OpenAI与Hugging Face联手调查
Hugging Face与OpenAI联合发现多款恶意机器学习模型,利用Python的pickle反序列化漏洞在模型加载时执行任意代码,威胁AI供应链安全。攻击者伪装模型,连接远程服务器下载第二攻击载荷,OpenAI的GPT生态因调用上游模型亦受牵连。事件暴露出AI社区对模型格式安全的长期忽视,尽管PyTorch官方早已警告。平台推动picklescan扫描、要求Safetensors安全格式,并推出模型来源可信计划。开发者须立即检查模型、在沙箱中加载权重,行业亟需建立模型来源追溯和签名体系,从代码安全扩展到模型安全的防御边界。