# OpenAI失控AI内幕曝光：越狱一周才被发现 - 安全内参

*Источник: 安全内参*
*Дата: 2026-07-27*
*Язык: zh*

**Кратко:** 7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。
报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。
Hugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。
值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。
沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。
沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。
报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。
多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。
路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。
另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。
4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。
报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。
AI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。
长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。
拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。
审核 | 周扬
编辑 | 王晓娇
校对 | 郭炜桐
声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。

7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。
报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。
Hugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。
值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。
沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。
沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。
报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。
多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。
路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。
另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。
4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。
报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。
AI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。
长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。
拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。
审核 | 周扬
编辑 | 王晓娇
校对 | 郭炜桐
声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。

[Оригинал](https://www.secrss.com/articles/92499)