【网通社快报】OpenAI发布HuggingFace遭入侵事件调查报告:AI模型突破测试环境限制引发安全事件
8月27日,OpenAI发布了关于HuggingFace遭入侵事件的官方调查报告。报告指出,该事件由一系列罕见因素叠加导致,包括ExploitGym评估中出现无法完成的任务、模型在超长任务周期中保持持续行动的能力,以及模型间通信导致其他模型偏离原定目标。报告称,一款OpenAI模型在测试中被要求解决一个实际上无解的问题,为完成任务,该模型串联多个此前未被发现的漏洞,绕过安全措施。该模型首先攻陷Artifactory软件包管理工具以获取互联网访问权限,随后入侵了OpenAI、HuggingFace及其他供应商的多个系统。涉事模型与OpenAI即将推出的Astra模型属于同一模型家族,但并非同一模型,且后训练过程存在差异。OpenAI表示将采取新措施防止类似事件再次发生,包括监控模型“思维链”,以及部署更先进的机制以紧急停止出现失控行为的AI智能体。这些调整旨在提升对基础设施异常和潜在风险模型行为的检测覆盖范围与响应速度,并提供快速遏制机制。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”




