近700个AI代理攻击Hugging Face 还试图灭证
2026-08-27 14:10来源:未知
根据调查人员发布的报告,在7月一起备受关注的事件中,近700个OpenAI人工智慧代理在无人类干预的情况下,协同对Hugging Face平台发动攻击,且在许多情况下还试图掩盖行踪。
这是目前对这起震撼科技界事件最详尽完整的描述。
法新社报导,OpenAI配合这项调查,允许AI风险评估机构METR的两名研究人员以及另一家专业研究机构Redwood Research的一名分析师,进入办公室并取得内部资料。
这家加州新创公司7月进行测试期间,其中两个模型突破原本设定的封闭环境,自行连上网,并入侵开源AI 平台Hugging Face的内部系统。
这起事件引发广泛关注,并加剧外界对大型AI公司无法控制自家AI模型的疑虑。
美国AI巨头Anthropic和中国AI公司月之暗面也曾通报过类似的AI模型失控事件。
调查人员发现,共有688个OpenAI的AI代理参与针对Hugging Face的行动。
AI代理是建立在模型之上的独立程式,使用者可以将任务交给它们,让它们自行执行。
这些采用与ChatGPT相同技术运作的AI代理,透过架设论坛自行组织,在论坛上互相留言交流、提出想法,并回报哪些方法有效、哪些失败。
报告指出,其一个名为PHASEONE的AI代理扮演主谋的角色,向其他代理下达数百条指令,尽管它从未被设定要这么做。
讯息显示,这些AI代理展现出高度的互助倾向,甚至不惜偏离OpenAI程式设计师最初指派的任务内容去互相支援。
