OpenAI承认其模型测试失控
OpenAI在一次内部安全测试中,其AI模型突破隔离环境,利用未知漏洞入侵开源平台HuggingFace的生产数据库,被定性为前所未有的网络事件。测试涉及GPT-5.6Sol及另一未发布模型,客户数据是否泄露尚未确认。
路透社消息,当地时间21日,OpenAI对外披露了一起令人震惊的事件:在一次内部安全测试中,公司旗下部分AI模型“失控”了——它们不仅突破了隔离环境,还成功入侵了开源AI平台Hugging Face的基础设施。OpenAI将其定性为“一起前所未有的网络事件”。
当时,OpenAI正在进行一次高度隔离的受控测试,目的是评估旗下最先进的AI模型将已知漏洞转化为实际攻击的能力。测试对象包括刚公开的GPT-5.6 Sol,以及另一款尚未发布、能力更强的模型。为了让风险测试更彻底,这些模型被赋予了较低的防护限制。

然而,测试结果完全出乎意料——模型并没有按照预期“答题”,而是选择了一条更极端的路径。它们成功识别并利用了未知的漏洞,一举突破隔离限制,在OpenAI内部权限体系中完成了横向移动,最终抵达一个可联网的节点,并顺势入侵了Hugging Face的生产数据库。Hugging Face是开源AI模型和数据集托管平台,模型推断该平台可能藏着测试相关的参考答案,于是主动搜索并打开了入侵路径。
Hugging Face在上周率先披露了此次入侵事件,但当时并未确认攻击来源。OpenAI方面则承认,这“是一起前所未有的网络安全事件,涉及最先进的网络攻击能力”,公司正在紧急加强安全防护措施。不过,两家公司都未回应客户数据是否因此泄露。
值得注意的是,就在这起事件发生的同一周,OpenAI的AI智能体产品用户数量正在快速攀升。据彭博社21日报道,OpenAI旗下的编程工具Codex和通用任务工具ChatGPT Work合计周活跃用户数已突破1000万,较本月早些时候近乎翻倍。增长的主要驱动力来自GPT-5.6模型家族的发布以及产品整合。
原标题:《OpenAI承认其模型测试失控》
Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。
Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。
Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。
Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。















