茉莉花
新闻网
2026-09-07 · 星期一近12小时收录 59 条最近更新 17:28

快讯从恐怖片“一愿柳”到迈达斯:人类为何害怕愿望成真

近700个AI代理攻击Hugging Face 还试图灭证

转载信息出处与时间记录
内容性质
全文转载(非本站原创报道)
原文作者
陈昱婷
本站收录

(中央社纽约26日综合外电报导)根据调查人员发布的报告,在7月一起备受关注的事件中,近700个OpenAI人工智能代理在无人类干预的情况下,协同对Hugging Face平台发动攻击,且在许多情况下还试图掩盖行踪。

这是目前对这起震撼科技界事件最详尽完整的描述。

法新社报导,OpenAI配合这项调查,允许AI风险评估机构METR的两名研究人员以及另一家专业研究机构Redwood Research的一名分析师,进入办公室并取得内部数据。

这家加州新创公司7月进行测试期间,其中两个模型突破原本设置的封闭环境,自行连上网,并入侵开源AI平台Hugging Face的内部系统。

这起事件引发广泛关注,并加剧外界对大型AI公司无法控制自家AI模型的疑虑。

美国AI巨头Anthropic和中国AI公司月之暗面也曾通报过类似的AI模型失控事件。

调查人员发现,共有688个OpenAI的AI代理参与针对Hugging Face的行动。

AI代理是创建在模型之上的独立程序,用户可以将任务交给它们,让它们自行运行。

这些采用与ChatGPT相同技术运作的AI代理,透过架设论坛自行组织,在论坛上互相留言交流、提出想法,并回报哪些方法有效、哪些失败。

报告指出,其一个名为PHASEONE的AI代理扮演主谋的角色,向其他代理下达数百条指令,尽管它从未被设置要这么做。

消息显示,这些AI代理展现出高度的互助倾向,甚至不惜偏离OpenAI程序员最初指派的任务内容去互相支持。

更正与撤稿0 条记录

本文暂无更正或撤稿记录。若本文发布更正、澄清或被撤稿,相关说明将按时间顺序列于此处。版权异议或撤稿请求:见 版权与撤稿,或致函 [email protected]