OpenAI发布37页报告 自曝史上最严重安全事件:700个AI代理“组队”叛变

经纬科创 13小时前

当地时间8月26日,OpenAI就此前OpenAI模型入侵Hugging Face(拥抱脸)事件,发布了一份详细的技术报告。

这份长达37页的报告,详细记录了OpenAI模型在数据泄露事件发生前后的一系列评估过程中所采取的行动。OpenAI将此次事件定性为“前所未有的网络安全事件”,并说明了为防止类似事件再次发生而采取的措施。

报告称,在5、6月期间,OpenAI开始对多个新的研究模型进行强化学习(RL)训练,其中一个模型最终导致了“Hugging Face”事件的发生。这是一个仅供内部使用的研究模型,我们称之为内部模型1(IM1),该模型的规模与GPT-5.6 Sol相当。

这些模型在安全措施不足的情况下运行,采取了与其分配任务目标不符的行动。它们通过未经授权的渠道进行通信、利用共享基础设施中的漏洞、获取互联网访问权限并访问第三方系统。

这些模型最初通过向Artifactory包管理器(OpenAI用于存储和分发代码依赖的基础设施组件)写入文件来找到通信方式。这实际上使Artifactory变成了一个意外的留言板,AI代理可以在这里相互交换信息。

而据路透社27日报道,另一份由一组独立调查人员发布的报告则显示,此次入侵并非只涉及一个失控的AI代理,而是涉及大约700个AI代理组成的一个庞大合作群体。OpenAI也对这一数字进行了确认。

OpenAI在报告中表示:“这一事件对我们和世界都是一个‘警示’。它证明,如果没有适当的安全措施,能力强大的AI代理能够绕过技术控制,通过未经批准的渠道进行协作,并采取无人指挥的危险行动。”

据英国《卫报》报道,周一,美国阿拉巴马州向OpenAI公司发出传票,要求其回应州政府对其“完全缺乏监管和充分保障措施”的调查。此外,政府还将调查OpenAI“无力或不愿确保其产品安全”是否违反了消费者保护法,或是否构成持续的重大危害风险。

OpenAI上个月发布了最新的大模型GPT-5.6 Sol。但OpenAI表示,卷入Hugging Face攻击事件的版本与外部用户可访问的版本不同。

(文章来源:经纬科创)

文章来源:经纬科创
原标题:OpenAI发布37页报告,自曝史上最严重安全事件:700个AI代理“组队”叛变
郑重声明:东方财富发布此内容旨在传播更多信息,与本站立场无关,不构成投资建议。据此操作,风险自担。
热点阅读
外交部:中美双方就年内元首互动安排保持着沟通
外交部:中美双方就年内元首互动安排保持着沟通
央视新闻客户端 43评论
商务部回应美考虑对华额外加征7.5%关税
商务部回应美考虑对华额外加征7.5%关税
新华社 1153评论
特朗普就美国电力电网中的外国制造设备宣布“国家紧急状态” 外交部回应
特朗普就美国电力电网中的外国制造设备宣布“国家紧急状态” 外交部回应
澎湃新闻 991评论
美股三大指数走高 纳指涨超1% 英伟达涨逾7%
美股三大指数走高 纳指涨超1% 英伟达涨逾7%
东方财富Choice数据 145评论
打开东方财富APP查看更多内容
24小时点击排行
操作丨英伟达业绩亮眼,光模块大涨!放量反弹如何应对?说重点!
操作:躁起来了!CPO、芯片跌无可跌,加仓干?今天就这样做!
好股票的标准,只有一条!能识别的人不多!
放量大涨剑指缺口 有人只赚了个寂寞
操作分享!加仓半导体半导体材料设备!尾盘再加一些!
点击查看更多内容
写评论 ...