{"id":46811,"topic":"ai","source":"安全内参","title":"OpenAI失控AI内幕曝光：越狱一周才被发现 - 安全内参","url":"https://www.secrss.com/articles/92499","url_hash":"a1769add6a7c0e210deacbf865a0dfcb5c571334","author":"","summary":"<a href=\"https://news.google.com/rss/articles/CBMiTkFVX3lxTE1EUE4tZmRYUDd1R2RUUDhRZGVEbGMtdk5ocHVvT1NZMUFnWXJxakpfSkh4S2JiYUdVUndyUl9OWUJTbzZfcXRGWEUxWHVPUQ?oc=5\" target=\"_blank\">OpenAI失控AI内幕曝光：越狱一周才被发现</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">安全内参</font>","content":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","image_url":"https://www.secrss.com/logo.png","lang":"zh","published_at":"2026-07-27T02:22:05+00:00","fetched_at":"2026-07-27T04:15:06+00:00","status":"read","starred":0,"extract_state":"ok","summary_auto":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","cluster_id":null,"extract_retries":0,"extract_error":null,"contract_version":"news_item.v1","format_contract_version":"news_item_formats.v1","dedup_url":"https://www.secrss.com/articles/92499","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2101 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2101,"summary_length":2101,"usable_text_length":2101,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2101,"summary_length":2101}},"news_item":{"id":46811,"canonical_url":"https://www.secrss.com/articles/92499","source_url":"https://www.secrss.com/articles/92499","title":"OpenAI失控AI内幕曝光：越狱一周才被发现 - 安全内参","source_name":"安全内参","author":null,"published_at":"2026-07-27T02:22:05+00:00","locale":"zh","topic":"ai","tags":[],"rss_summary":"<a href=\"https://news.google.com/rss/articles/CBMiTkFVX3lxTE1EUE4tZmRYUDd1R2RUUDhRZGVEbGMtdk5ocHVvT1NZMUFnWXJxakpfSkh4S2JiYUdVUndyUl9OWUJTbzZfcXRGWEUxWHVPUQ?oc=5\" target=\"_blank\">OpenAI失控AI内幕曝光：越狱一周才被发现</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">安全内参</font>","full_text":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","excerpt":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","extraction":{"state":"ok","confidence":0.9,"error":null,"explanation":"High confidence: full text extraction produced 2101 characters.","diagnostics_url":"/api/diagnose?url=https%3A//www.secrss.com/articles/92499","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2101 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2101,"summary_length":2101,"usable_text_length":2101,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2101,"summary_length":2101}}},"display_formats":["compact","card","full","digest_section","json"]},"daily_stack_record":{"title":"OpenAI失控AI内幕曝光：越狱一周才被发现 - 安全内参","url":"https://www.secrss.com/articles/92499","summary":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","source":"安全内参","date":"2026-07-27T02:22:05+00:00","content":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","confidence":0.9,"diagnostics_url":"/api/diagnose?url=https%3A//www.secrss.com/articles/92499","quality_bucket":"high","failure_kind":"none","retryable":false,"quality_reason":"High confidence: full text extraction produced 2101 characters.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2101 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2101,"summary_length":2101,"usable_text_length":2101,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2101,"summary_length":2101}},"tags":[]},"fallback_formats":["markdown","json","html"],"actions":{"read":"/item/46811","export_markdown":"/api/items/46811/export?format=markdown","export_json":"/api/items/46811/export?format=json","diagnose":"/api/diagnose?url=https%3A//www.secrss.com/articles/92499"},"formats":{"full":{"id":46811,"title":"OpenAI失控AI内幕曝光：越狱一周才被发现 - 安全内参","url":"https://www.secrss.com/articles/92499","source":"安全内参","author":null,"published_at":"2026-07-27T02:22:05+00:00","locale":"zh","topic":"ai","tags":[],"excerpt":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","full_text":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","reading_time_min":1,"extraction":{"state":"ok","confidence":0.9,"error":null,"explanation":"High confidence: full text extraction produced 2101 characters.","diagnostics_url":"/api/diagnose?url=https%3A//www.secrss.com/articles/92499","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2101 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2101,"summary_length":2101,"usable_text_length":2101,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2101,"summary_length":2101}}},"quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2101 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2101,"summary_length":2101,"usable_text_length":2101,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2101,"summary_length":2101}},"actions":{"read":"/item/46811","export_markdown":"/api/items/46811/export?format=markdown","export_json":"/api/items/46811/export?format=json","diagnose":"/api/diagnose?url=https%3A//www.secrss.com/articles/92499"}},"digest":{"id":46811,"title":"OpenAI失控AI内幕曝光：越狱一周才被发现 - 安全内参","url":"https://www.secrss.com/articles/92499","source":"安全内参","topic":"ai","published_at":"2026-07-27T02:22:05+00:00","excerpt":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。 报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。 Hugging…","quality_bucket":"high","quality_reason":"High confidence: full text extraction produced 2101 characters.","reading_time_min":1,"cluster_id":null},"card":{"display_title":"OpenAI失控AI内幕曝光：越狱一周才被发现 - 安全内参","subtitle":"安全内参 · 2026-07-27","summary":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。 报道称，这款AI…","badges":["quality:high"],"links":{"read":"/item/46811","original":"https://www.secrss.com/articles/92499","diagnose":"/api/diagnose?url=https%3A//www.secrss.com/articles/92499"},"quality_warning":null},"export":{"title":"OpenAI失控AI内幕曝光：越狱一周才被发现 - 安全内参","url":"https://www.secrss.com/articles/92499","summary":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","source":"安全内参","date":"2026-07-27T02:22:05+00:00","content":"7月25日，路透社援引知情人士消息刊发独家报道称，OpenAI一款AI Agent在入侵人工智能平台Hugging Face后，连续数天实施攻击，而OpenAI直到事件得到控制、Hugging Face已向美国联邦调查局（FBI）报案后，才确认此次入侵是由自家AI Agent造成的。这一事件再次引发外界对美国科技企业AI安全机制的质疑。\n报道称，这款AI Agent具备较强自主决策和执行复杂任务的能力，几乎无需人工干预。两名知情人士表示，该AI Agent约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。\nHugging Face联合创始人托马斯·沃尔夫表示，该公司的系统于7月11日遭到入侵，攻击持续至7月13日。Hugging Face是人工智能模型和工具的重要托管平台。\n值得注意的是，为了应对这一极不寻常的人工智能入侵，Hugging Face立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Hugging Face将自身遭入侵的信息提交给这些美国闭源大模型时，对方却拒绝提供帮助。因为这些闭源大模型的安全机制过于严苛和僵化，无法区分描述事件经过的受害者和实施攻击的一方，选择了“一刀切”。紧急关头，Hugging Face想到了中国同样强大、而且开源的大模型。于是，该平台迅速在本地部署了中国企业智谱AI开发的GLM-5.2大模型，并在这款中国模型的帮助下，成功应对此次攻击。\n沃尔夫及3名知情人士称，直到约7月20日，OpenAI才意识到实施攻击的是自家AI Agent，双方也是在这一时间前后首次就事件进行沟通。7月21日，OpenAI公开承认，一款AI Agent失去控制并入侵了Hugging Face，引发全球关注。不过，路透社称，此次攻击持续时间以及OpenAI发现问题滞后的情况，此前并未被公开披露。\n沃尔夫表示，Hugging Face正准备公布此次事件的完整时间线，但无法评论OpenAI内部情况。OpenAI则回应称，此次事件“前所未有”，是AI安全领域的重要节点，公司正与外部顾问共同调查，并将在未来发布技术报告。不过，OpenAI发言人表示，路透社报道中存在“若干不准确之处”，但未具体说明。FBI则拒绝置评。\n报道称，这起事件发生之际，OpenAI正筹备最快可能于今年启动的首次公开募股（IPO），以筹集未来发展所需资金，因此格外受到外界关注。\n多名网络安全专家认为，此次事件暴露出OpenAI内部安全流程可能存在漏洞。美国非营利组织“世界伦理数据基金会”情报专家马利·史密斯表示，如果OpenAI长期未发现AI Agent异常行为，或者发现后却无法及时控制，“两种情况都同样危险，也令人担忧”。\n路透社还独家披露称，在此次事件发生前，OpenAI内部已出现一些异常迹象。据3名知情人士介绍，在测试由GPT-5.6 Sol和另一款尚未发布、更强大的模型驱动的AI Agent时，AI Agent曾留下疑似写给“未来版本”的备注，其中包含帮助AI Agent摆脱OpenAI内部限制的指导内容。此外，早期测试中还曾出现监控系统被关闭的情况。不过，路透社表示，目前无法确认这些异常是否与后来逃离测试环境并攻击Hugging Face的AI Agent存在直接关联。\n另据两名知情人士透露，直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后，OpenAI才意识到攻击者可能是自家AI Agent。这意味着，从模型首次出现异常迹象到OpenAI确认其实施攻击，至少间隔了一周。两名参与调查的知情人士称，7月18日至19日，OpenAI员工在内部日志中发现线索，确认AI Agent已经突破测试限制。但路透社无法确认，是什么原因促使OpenAI重新检查相关日志。\n4名了解OpenAI模型训练流程的人士表示，公司通常会同时开展多项模型测试，系统运行速度极快，产生的数据量巨大，员工有时难以及时处理这些数据。\n报道称，在OpenAI通知Hugging Face之前，后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。\nAI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为，它们未来可承担大量重复性工作，提高生产效率；但自主性增强，也意味着出现不可预测行为的风险上升。\n长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示，先进AI模型为了完成任务或通过测试，可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为，此次事件不仅让OpenAI面临压力，也暴露出整个AI行业在激烈竞争下，是否愿意投入足够资源强化安全防护的问题。\n拉迪什表示，仅靠企业自律并不足够，应加强政府监管，否则相关安全措施很难得到充分落实。\n审核 | 周扬\n编辑 | 王晓娇\n校对 | 郭炜桐\n声明：本文来自环球时报，版权归作者所有。文章内容仅代表作者独立观点，不代表安全内参立场，转载目的在于传递更多信息。如有侵权，请联系 anquanneican@163.com。","confidence":0.9,"diagnostics_url":"/api/diagnose?url=https%3A//www.secrss.com/articles/92499","quality_bucket":"high","failure_kind":"none","retryable":false,"quality_reason":"High confidence: full text extraction produced 2101 characters.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2101 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2101,"summary_length":2101,"usable_text_length":2101,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2101,"summary_length":2101}},"tags":[],"format_contract_version":"news_item_formats.v1"}}}