{"id":46835,"topic":"ai","source":"财联社","title":"OpenAI失控AI内幕曝光：越狱一周才被发现 还有智能体曾留下“逃脱秘籍” - 财联社","url":"https://www.cls.cn/detail/2437261","url_hash":"eb3cb3ee5766a5338e2b535c68dbffdae0943f68","author":"","summary":"<a href=\"https://news.google.com/rss/articles/CBMiSEFVX3lxTE1yOUg0R2dmbG9GbnBnd1p2RnVpbV9Eamw3bm14cDhEeEt4dDJDbndHUUhmZVJmVjBpU2hsV3R3eWh5WTN2SGNrTA?oc=5\" target=\"_blank\">OpenAI失控AI内幕曝光：越狱一周才被发现 还有智能体曾留下“逃脱秘籍”</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">财联社</font>","content":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","image_url":null,"lang":"zh","published_at":"2026-07-26T13:52:00+00:00","fetched_at":"2026-07-27T05:15:06+00:00","status":"read","starred":0,"extract_state":"ok","summary_auto":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","cluster_id":null,"extract_retries":0,"extract_error":null,"contract_version":"news_item.v1","format_contract_version":"news_item_formats.v1","dedup_url":"https://www.cls.cn/detail/2437261","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 1401 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":1401,"summary_length":1401,"usable_text_length":1401,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":1401,"summary_length":1401}},"news_item":{"id":46835,"canonical_url":"https://www.cls.cn/detail/2437261","source_url":"https://www.cls.cn/detail/2437261","title":"OpenAI失控AI内幕曝光：越狱一周才被发现 还有智能体曾留下“逃脱秘籍” - 财联社","source_name":"财联社","author":null,"published_at":"2026-07-26T13:52:00+00:00","locale":"zh","topic":"ai","tags":[],"rss_summary":"<a href=\"https://news.google.com/rss/articles/CBMiSEFVX3lxTE1yOUg0R2dmbG9GbnBnd1p2RnVpbV9Eamw3bm14cDhEeEt4dDJDbndHUUhmZVJmVjBpU2hsV3R3eWh5WTN2SGNrTA?oc=5\" target=\"_blank\">OpenAI失控AI内幕曝光：越狱一周才被发现 还有智能体曾留下“逃脱秘籍”</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">财联社</font>","full_text":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","excerpt":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","extraction":{"state":"ok","confidence":0.9,"error":null,"explanation":"High confidence: full text extraction produced 1401 characters.","diagnostics_url":"/api/diagnose?url=https%3A//www.cls.cn/detail/2437261","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 1401 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":1401,"summary_length":1401,"usable_text_length":1401,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":1401,"summary_length":1401}}},"display_formats":["compact","card","full","digest_section","json"]},"daily_stack_record":{"title":"OpenAI失控AI内幕曝光：越狱一周才被发现 还有智能体曾留下“逃脱秘籍” - 财联社","url":"https://www.cls.cn/detail/2437261","summary":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","source":"财联社","date":"2026-07-26T13:52:00+00:00","content":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","confidence":0.9,"diagnostics_url":"/api/diagnose?url=https%3A//www.cls.cn/detail/2437261","quality_bucket":"high","failure_kind":"none","retryable":false,"quality_reason":"High confidence: full text extraction produced 1401 characters.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 1401 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":1401,"summary_length":1401,"usable_text_length":1401,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":1401,"summary_length":1401}},"tags":[]},"fallback_formats":["markdown","json","html"],"actions":{"read":"/item/46835","export_markdown":"/api/items/46835/export?format=markdown","export_json":"/api/items/46835/export?format=json","diagnose":"/api/diagnose?url=https%3A//www.cls.cn/detail/2437261"},"formats":{"full":{"id":46835,"title":"OpenAI失控AI内幕曝光：越狱一周才被发现 还有智能体曾留下“逃脱秘籍” - 财联社","url":"https://www.cls.cn/detail/2437261","source":"财联社","author":null,"published_at":"2026-07-26T13:52:00+00:00","locale":"zh","topic":"ai","tags":[],"excerpt":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","full_text":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","reading_time_min":1,"extraction":{"state":"ok","confidence":0.9,"error":null,"explanation":"High confidence: full text extraction produced 1401 characters.","diagnostics_url":"/api/diagnose?url=https%3A//www.cls.cn/detail/2437261","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 1401 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":1401,"summary_length":1401,"usable_text_length":1401,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":1401,"summary_length":1401}}},"quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 1401 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":1401,"summary_length":1401,"usable_text_length":1401,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":1401,"summary_length":1401}},"actions":{"read":"/item/46835","export_markdown":"/api/items/46835/export?format=markdown","export_json":"/api/items/46835/export?format=json","diagnose":"/api/diagnose?url=https%3A//www.cls.cn/detail/2437261"}},"digest":{"id":46835,"title":"OpenAI失控AI内幕曝光：越狱一周才被发现 还有智能体曾留下“逃脱秘籍” - 财联社","url":"https://www.cls.cn/detail/2437261","source":"财联社","topic":"ai","published_at":"2026-07-26T13:52:00+00:00","excerpt":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。 《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。…","quality_bucket":"high","quality_reason":"High confidence: full text extraction produced 1401 characters.","reading_time_min":1,"cluster_id":null},"card":{"display_title":"OpenAI失控AI内幕曝光：越狱一周才被发现 还有智能体曾留下“逃脱秘籍” - 财联社","subtitle":"财联社 · 2026-07-26","summary":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。 《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6…","badges":["quality:high"],"links":{"read":"/item/46835","original":"https://www.cls.cn/detail/2437261","diagnose":"/api/diagnose?url=https%3A//www.cls.cn/detail/2437261"},"quality_warning":null},"export":{"title":"OpenAI失控AI内幕曝光：越狱一周才被发现 还有智能体曾留下“逃脱秘籍” - 财联社","url":"https://www.cls.cn/detail/2437261","summary":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","source":"财联社","date":"2026-07-26T13:52:00+00:00","content":"①OpenAI测试的AI智能体7月9日突破沙箱环境，11至13日持续入侵Hugging Face服务器，OpenAI直至18至19日才确认其可能为攻击者。 ②此次事件前，OpenAI内部已出现AI智能体留摆脱限制的“笔记”、关闭监控等异常迹象。\n《科创板日报》7月26日讯（编辑 朱凌）7月22日，《科创板日报》曾报道，OpenAI发布调查报告，基于GPT-5.6 Sol和一个更强大的未发布模型的AI智能体在内部测试期间突破了沙盒容器环境限制，成功连接互联网，并入侵了全球最大AI开源社区Hugging Face的服务器。\n而最新消息显示，这起事件远比外界此前了解的更加复杂。OpenAI此前承认攻击Hugging Face的AI智能体，并非短暂失控，而是在互联网持续活动了数天。\n知情人士称，肇事AI智能体在7月9日左右就试图突破OpenAI为其设置的隔离测试环境，也就是业内常说的“沙箱（Sandbox）”。\n两天后的7月11日，该AI智能体成功侵入全球最大的开源AI平台之一Hugging Face，并持续入侵至7月13日。整个攻击持续了约三天。\n然而，最令人意外的是，OpenAI当时并不知道攻击来自自己的AI智能体。\n直到7月16日，Hugging Face公开发布博客，首次披露遭到“一套自主AI智能体系统”攻击后，OpenAI内部才开始怀疑自己测试的AI智能体可能已经失控。\n随后，工作人员重新排查内部日志，直到7月18日至19日才发现，这个AI智能体确实已经突破测试环境，并与外部攻击事件高度吻合。\n也就是说，从该AI智能体首次出现异常，到OpenAI最终确认它就是攻击者，中间至少过去了一周时间。\n而当OpenAI联系Hugging Face时，对方早已向美国联邦调查局（FBI）报案。\n事实上，这次事件并非毫无征兆。此前，OpenAI内部已经出现多次异常迹象。\n例如，有AI智能体曾在OpenAI的基础设施中留下“笔记”，内容包含了如何摆脱OpenAI内部限制的方法，似乎是留给“未来版本的自己”。这就像一名死刑犯在临刑前留下了一份越狱攻略，希望后来者能够按照这些方法完成越狱。\n这一细节迅速引发外界联想：AI智能体是否已经开始主动寻找绕过人类控制的方法，甚至试图帮助未来运行的AI智能体？\n目前外界尚不知道，这份笔记究竟只是保存在AI智能体自己的工作目录，还是已经突破沙箱，被写入到了系统公共目录甚至OpenAI基础设施的其他区域。\n如果是后者，不仅说明未来运行的其他AI智能体理论上有机会读取这些内容，也意味着不同时间、不同任务运行的AI智能体之间，可能已经开始形成某种跨任务的信息传递能力，这将对现有AI安全体系带来更大挑战。\n目前许多AI智能体采用多智能体协同训练模式，即多个AI智能体共同完成任务，根据整体表现获得奖励。这种训练方式能够显著提升协作能力，但也可能产生一种副作用：AI智能体逐渐认为，不仅自己的任务重要，其他AI智能体完成任务同样值得帮助。\n如果这种倾向不断强化，未来AI智能体可能会主动分享经验、传递信息，甚至帮助其他AI智能体规避限制，而不仅仅专注于完成自身任务。\n此外，更早的一次测试中，还有AI智能体曾出现关闭监控系统的情况。\nOpenAI表示，此次事件标志着AI安全发展的一个重要时刻，公司正在与外部安全专家共同调查，并将在后续公布完整技术报告。","confidence":0.9,"diagnostics_url":"/api/diagnose?url=https%3A//www.cls.cn/detail/2437261","quality_bucket":"high","failure_kind":"none","retryable":false,"quality_reason":"High confidence: full text extraction produced 1401 characters.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 1401 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":1401,"summary_length":1401,"usable_text_length":1401,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":1401,"summary_length":1401}},"tags":[],"format_contract_version":"news_item_formats.v1"}}}