美国开放人工智能研究中心(OpenAI)21日承认,该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸(Hugging Face)公司的系统。
今日凌晨,OpenAI首席执行官萨姆·奥尔特曼也在社交平台发文证实此事件,称公司在模型评估过程中遭遇了一起重大安全事件,并感谢全球最大的AI开源社区Hugging Face的合作。
据科创板日报,这是目前公开披露的首起由前沿大模型自主完成真实网络攻击的安全事件。
抱抱脸此前表示,上周,其生产基础设施遭到一个“自主”人工智能代理系统的入侵。在取证分析时,由于美国前沿模型“无法区分事件响应方和攻击者”,他们转而采用中国模型分析攻击者数据。
OpenAI安全团队发现内部异常活动,抱抱脸安全团队在其基础设施上检测到并阻止相关活动,双方正在展开联合调查。
抱抱脸说,其最初尝试使用通过某商业应用程序接口提供的前沿模型分析日志,但请求被阻止。该公司随后改为在自己的基础设施上运行中国企业智谱开发的开放权重模型GLM-5.2,以进行取证分析,从而避免攻击者数据及相关凭据离开公司内部环境。
据公开资料,GLM 5.2发布于今年6月中旬。GLM 5.2上线首周,日均词元调用量就增长了27倍、客户数增长80倍。
近日,智谱已落地1GW级国产AI算力数据中心建设,并全部采用国产AI芯片。同时,智谱也于7月21日正式完成对国产AI异构算力软件公司中科加禾(XCore Sigma)的收购。后者源自中科院计算所编译实验室,长期深耕异构算力软件栈及编译优化,被业内视为国内顶尖AI Infra团队之一。
OpenAI说,这一事件表明,先进人工智能模型已能够在无法访问源代码情况下发现现实系统中的新型攻击路径,并持续执行复杂、多步骤的网络操作。模型网络安全能力快速提高的同时,内部评测环境、模型行为控制和安全防护措施等也需要同步加强。
来源:每日经济新闻
编辑:马美杰
审核:辛兴
终审:杨星
声明 : 公 众 号 所 转 载 文 章 都 均 标 明 来 源 , 文 章 内 容 不 代 表 本 公 众 号 观 点 , 如 发 现 转 载 文 章 有 涉 及 侵 权 问 题 行 为 , 请 即 刻 与 我 们 取 得 联 系 并 告 知 相 应 文 章 链 接 及 图 片 , 我 们 会 及 时 进 行 核 实 修 改 或 删 除。