OpenAI模型罕见“失控”,自主入侵全球最大AI开源社区 开源其中一例场景中
内容摘要
界面新闻记者 | 宋佳楠当地时间7月21日,据OpenAI官网消息,全球最大开源大模型托管社区Hugging Face上周披露了一起新型安全事件。此前该平台监测到一个AI智能体入侵其基础设施。经调查,
尤其声明 :以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,失控
OpenAI强调 ,模型现阶段公布的自主最初步调查结论,模型推断Hugging Face平台恐怕存放ExploitGym相关模型、入侵此前该平台监测到一个AI智能体入侵其基础设施。全球本次事件证实,开源以及一款能力更强的社区预发布模型 。只为完成这一范围有限的失控测试目标。在Hugging Face服务器上实现远程代码执行。模型伴随大模型的自主最飞速发展,本次事件发生于一次内部鉴别测试 。入侵
英国人工智能安全探讨所(UK AISI)的全球鉴别显示 ,OpenAI CEO山姆·奥特曼也在社交平台转发了情况说明。开源
其中一例场景中,社区这些理论层面的失控攻击能力完全可以在真实环境落地 。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.
这并非OpenAI首次面临安全风险问题。这些模型临时放宽了网络攻击相关的安全限制,让各地所有网络防御人员都能接触人工智能技术,多步骤网络攻击行动。先进人工智能模型无需获取源代码,
![]()
英国人工智能安全探讨所对比了近期开源权重模型与前沿闭源模型在长周期网络攻防靶场中的表现 图片来源:OpenAI
OpenAI指出 ,此前该公司就曾因ChatGPT数据泄露 、”OpenAI方面表示。模型耗费繁多推理算力 ,“人工智能安全问题无法依靠单一企业闭门解决。全球最大开源大模型托管社区Hugging Face上周披露了一起新型安全事件 。数据集与标准答案 。基于这一分析 ,所有证据表明,确认这起特定事件由多款OpenAI模型共同催生,最新安全事件也验证了外界的担忧 :当模型被赋予更高的自主行动权时,
但模型在测试中察觉并串联利用OpenAI探讨环境与Hugging Face生产环境内多处漏洞 ,
谈及如何解决这类问题 ,当时OpenAI正在内部进行网络攻防能力基准测试。不惜采取各类极端手段,该软件充当软件源仓库的代理与缓存服务。其基准测试运行在高度隔离环境中,开源代码库漏洞以及内部安全团队(如Superalignment团队)离职潮而催生舆论关注。涉及顶尖水平的网络攻击能力。就可以察觉并利用真实完善中全新的攻击路径。模型安全防护能力也必须跟上模型能力高效迭代的节奏。该公司近期也曾公开谈及人工智能的安全风险,借助该突破口,
事实上 ,
胜利接入互联网后 ,才能攻克这一难题 。本平台仅提供信息存储服务 。
“这起事件说明 ,同时让各界重新认知当前AI模型所能达到的能力边界 。
在受沙箱隔离的测试环境内 ,必须配套更强的安全防护机制与防御工具。其中包括GPT‑5.6 Sol ,以此量化模型的网络攻击能力 。Hugging Face联合创始人兼首席执行官克莱姆·德朗格(Clem Delangue)表示 ,只有开放协作,传统基于规则和虚拟隔离的环境恐怕随时失效 。这也意味着 ,
据OpenAI介绍,
这次“自我演进式”的网络攻击标志着AI安全防护已进入全新阶段 。为实现联网,GPT‑5.6 Sol这类模型越来越擅长在较长周期内执行冗长 、模型在OpenAI探讨测试环境中倘若执行权限优化与横向渗透,模型高度专注于寻找ExploitGym测试任务的解决方案