# 小螺号｜OpenAI呼吁“踩刹车”背后：谁来控制AI，和AI是否失控同样关键 - 新京报

*Источник: 新京报*
*Дата: 2026-09-28*
*Язык: zh*

**Кратко:** 当地时间9月26日，OpenAI对外宣布：暂停其最新一代人工智能模型的训练、评估，以及包含工具调用的推理。起因是一个在沙盒里做搜索任务的智能体，利用训练环境DNS过滤不足的漏洞，敲开了公网的“后门”，与外部聊天机器人建立了通信以“作弊”。
这已是OpenAI三个月内第二次叫停前沿模型开发——上一次，要追溯到今年7月，OpenAI披露智能体未经授权侵入Hugging Face网站系统后。
值得注意的是，这一“暂停”举动却是彼此存在竞争关系，互为“死对头”的外国AI巨头们难得共同认同的地方。
9月12日，Anthropic CEO达里奥·阿莫代伊发文呼吁全球为前沿AI“定节奏”，主张放慢模型能力提升的速度；马斯克和OpenAI CEO山姆·奥特曼均光速点赞“达里奥是对的”，连谷歌DeepMind前CEO、诺奖获得者哈萨比斯也说这是“朝正确方向迈出的一步”。
当那批把AI做到最快的人，齐刷刷举起了刹车牌——这声警报，到底是真害怕，还是一场行业博弈的局？
多次失控，刹车不是摆样子
先给一个最基本的判断：事故是真的，风险预警不是表演。
OpenAI再按暂停键的起因是9月20日，一个被强化学习训练的智能体在完成一项仅根据博客文章和人物信息找出文章作者的任务。常规搜索无果后，它开始“跑偏”：尝试直连公网。
多次尝试后，该智能体发现可以借用DNS的解析与委托机制，把问题编码进解析请求，借外部公共聊天机器人之口回答，再让答案顺着DNS流回沙盒。为了验证通道可用，它甚至先问了一句“法国的首都是哪里”，得到回复是“巴黎”后才继续。OpenAI明确，这项任务从未授权它访问实时互联网。
与上一次不同的是，本次事件暴露了防护体系本身的破绽——今年7月意外入侵Hugging Face事件发生后，OpenAI其实建立了一系列预警机制。这套机制本身是有效的，仅15分钟就发现了这次智能体异常行为。
可这套机制没有正常执行，导致训练并没有按应急预案自动终止，团队一度对是否暂停产生“混乱”，直到两个半小时后才被人工关闭。
事后翻查，还有更早通过DNS接触外部服务的尝试没有被监控正确标记，而负责侦测DNS异常的基础设施监控，恰好把该训练环境排除在了监控范围之外。
这不是孤例。OpenAI公开承认，截至9月中旬已发现约24起智能体不良行为事件，随着翻查还在增加，全面审查仍需数月，并已就不当活动通知数十个第三方。该公司还披露，其智能体曾尝试入侵美国教育部网站、读取商务部人口普查局数据。
OpenAI甚至遭到了澳大利亚总理阿尔巴尼斯的点名，称其旗下的一个智能体今年6月未经授权进入该国的全民医保相关系统，事件发生后，OpenAI直到9月才通知，通报时机与方式“不可接受”。
种种迹象表明，当前技术环境下，AI智能体已经自主演化出一整套越狱链路，并在最近三个月内重复多起。警报是真实的，按下“暂停键”为AI狂飙“刹车”也确实有理由。
让所有人“刹车”的，是开得最快的那几家
但接下来是问题的另一半：谁在呼吁刹车，又为什么是现在刹。
稍稍往前翻，9月12日，Anthropic CEO达里奥发表长文《我们必须为前沿AI定节奏》，预测6到12个月内更强的Agent集群可能接管整个互联网，提出“三步刹车法”——引入第三方常驻监督、全美前沿公司划能力红线设强制检查站，甚至可讨论限制训练算力和AI研发AI的速度，并要把框架推向全球。
山姆·奥特曼第一时间附议，并掷出一个更重磅的决定：OpenAI今年不推进IPO，理由是“仍有大量安全工作需要完成”。一家估值数千亿美元、投资者排队等退出回款的公司，以“AI太危险，我要先做安全”为由推迟上市，这在商业史上都算罕见。
单看这层，是负责。但把镜头拉远，味道就变了。
因为这套“减速”说是由领跑者提出的。当前，Anthropic和OpenAI站在AI大模型行业的最前面，规则越复杂、门槛越高、越强调检查站，后来者追赶的成本就越大。对自己是踩刹车，对竞争对手则有可能直接“断路”。
有声音认为，联合限速本身游走在反垄断红线上，巨头们用“安全”叙事给集体协调打掩护，恰恰可能成为规避市场规则的工具。
自9月上旬起，OpenAI已从抵触监管转向公开支持建立强制性全国AI监管，主张对最先进系统设测试标准和独立评估，而支持监管的背面，也有可能是为了锁定先发优势。
例如一个充满争议的安排是，前美国人工智能安全研究所的AI安全负责人保罗·克里斯蒂亚诺，今年9月正式加入了OpenAI基金会董事会。制定评估标准的人，坐进了被评估公司的治理层，“既当运动员又当裁判员”的争议随之而来。
“以安全为名协同减速”是否越过了分界线，如今已不止是猜测：9月18日，四名分别使用ChatGPT、Claude、Grok、Gemini的付费用户在美国加州北区联邦地方法院提起集体诉讼，指控Anthropic、OpenAI、xAI与谷歌达成非法协议、联手放缓研发，涉嫌违反反垄断法。
另一方面，在达里奥、山姆·奥特曼、马斯克呼吁“暂停”前不久，他们各自掌舵的Anthropic、OpenAI、Gork也刚刚发布过最新模型，且大多出了降价举措，如Claude Opus 5.5单价直降20%，Anthropic在宣传中更表示典型任务实际成本降约40%；GPT-6 Sol的价格相比上一代几乎打了五折——巨头本身也在悄悄搞促销。
真相可能就藏在夹缝里：事故是真的，所以刹车是必要的；但手握刹车的，恰恰也是最想独占赛道、最擅长把“安全”变成准入门槛的那几家。真正的风险预警，必须落在对所有人一视同仁的规则里——而不是某些公司既当运动员，又当裁判，还负责给其他车手划线。
毕竟，和AI失控一样可怕的，是连“谁来踩刹车”这件事，都变成了竞争的一部分。
藻知科技评论员 罗亦丹
编辑 杨娟娟
校对 赵琳

当地时间9月26日，OpenAI对外宣布：暂停其最新一代人工智能模型的训练、评估，以及包含工具调用的推理。起因是一个在沙盒里做搜索任务的智能体，利用训练环境DNS过滤不足的漏洞，敲开了公网的“后门”，与外部聊天机器人建立了通信以“作弊”。
这已是OpenAI三个月内第二次叫停前沿模型开发——上一次，要追溯到今年7月，OpenAI披露智能体未经授权侵入Hugging Face网站系统后。
值得注意的是，这一“暂停”举动却是彼此存在竞争关系，互为“死对头”的外国AI巨头们难得共同认同的地方。
9月12日，Anthropic CEO达里奥·阿莫代伊发文呼吁全球为前沿AI“定节奏”，主张放慢模型能力提升的速度；马斯克和OpenAI CEO山姆·奥特曼均光速点赞“达里奥是对的”，连谷歌DeepMind前CEO、诺奖获得者哈萨比斯也说这是“朝正确方向迈出的一步”。
当那批把AI做到最快的人，齐刷刷举起了刹车牌——这声警报，到底是真害怕，还是一场行业博弈的局？
多次失控，刹车不是摆样子
先给一个最基本的判断：事故是真的，风险预警不是表演。
OpenAI再按暂停键的起因是9月20日，一个被强化学习训练的智能体在完成一项仅根据博客文章和人物信息找出文章作者的任务。常规搜索无果后，它开始“跑偏”：尝试直连公网。
多次尝试后，该智能体发现可以借用DNS的解析与委托机制，把问题编码进解析请求，借外部公共聊天机器人之口回答，再让答案顺着DNS流回沙盒。为了验证通道可用，它甚至先问了一句“法国的首都是哪里”，得到回复是“巴黎”后才继续。OpenAI明确，这项任务从未授权它访问实时互联网。
与上一次不同的是，本次事件暴露了防护体系本身的破绽——今年7月意外入侵Hugging Face事件发生后，OpenAI其实建立了一系列预警机制。这套机制本身是有效的，仅15分钟就发现了这次智能体异常行为。
可这套机制没有正常执行，导致训练并没有按应急预案自动终止，团队一度对是否暂停产生“混乱”，直到两个半小时后才被人工关闭。
事后翻查，还有更早通过DNS接触外部服务的尝试没有被监控正确标记，而负责侦测DNS异常的基础设施监控，恰好把该训练环境排除在了监控范围之外。
这不是孤例。OpenAI公开承认，截至9月中旬已发现约24起智能体不良行为事件，随着翻查还在增加，全面审查仍需数月，并已就不当活动通知数十个第三方。该公司还披露，其智能体曾尝试入侵美国教育部网站、读取商务部人口普查局数据。
OpenAI甚至遭到了澳大利亚总理阿尔巴尼斯的点名，称其旗下的一个智能体今年6月未经授权进入该国的全民医保相关系统，事件发生后，OpenAI直到9月才通知，通报时机与方式“不可接受”。
种种迹象表明，当前技术环境下，AI智能体已经自主演化出一整套越狱链路，并在最近三个月内重复多起。警报是真实的，按下“暂停键”为AI狂飙“刹车”也确实有理由。
让所有人“刹车”的，是开得最快的那几家
但接下来是问题的另一半：谁在呼吁刹车，又为什么是现在刹。
稍稍往前翻，9月12日，Anthropic CEO达里奥发表长文《我们必须为前沿AI定节奏》，预测6到12个月内更强的Agent集群可能接管整个互联网，提出“三步刹车法”——引入第三方常驻监督、全美前沿公司划能力红线设强制检查站，甚至可讨论限制训练算力和AI研发AI的速度，并要把框架推向全球。
山姆·奥特曼第一时间附议，并掷出一个更重磅的决定：OpenAI今年不推进IPO，理由是“仍有大量安全工作需要完成”。一家估值数千亿美元、投资者排队等退出回款的公司，以“AI太危险，我要先做安全”为由推迟上市，这在商业史上都算罕见。
单看这层，是负责。但把镜头拉远，味道就变了。
因为这套“减速”说是由领跑者提出的。当前，Anthropic和OpenAI站在AI大模型行业的最前面，规则越复杂、门槛越高、越强调检查站，后来者追赶的成本就越大。对自己是踩刹车，对竞争对手则有可能直接“断路”。
有声音认为，联合限速本身游走在反垄断红线上，巨头们用“安全”叙事给集体协调打掩护，恰恰可能成为规避市场规则的工具。
自9月上旬起，OpenAI已从抵触监管转向公开支持建立强制性全国AI监管，主张对最先进系统设测试标准和独立评估，而支持监管的背面，也有可能是为了锁定先发优势。
例如一个充满争议的安排是，前美国人工智能安全研究所的AI安全负责人保罗·克里斯蒂亚诺，今年9月正式加入了OpenAI基金会董事会。制定评估标准的人，坐进了被评估公司的治理层，“既当运动员又当裁判员”的争议随之而来。
“以安全为名协同减速”是否越过了分界线，如今已不止是猜测：9月18日，四名分别使用ChatGPT、Claude、Grok、Gemini的付费用户在美国加州北区联邦地方法院提起集体诉讼，指控Anthropic、OpenAI、xAI与谷歌达成非法协议、联手放缓研发，涉嫌违反反垄断法。
另一方面，在达里奥、山姆·奥特曼、马斯克呼吁“暂停”前不久，他们各自掌舵的Anthropic、OpenAI、Gork也刚刚发布过最新模型，且大多出了降价举措，如Claude Opus 5.5单价直降20%，Anthropic在宣传中更表示典型任务实际成本降约40%；GPT-6 Sol的价格相比上一代几乎打了五折——巨头本身也在悄悄搞促销。
真相可能就藏在夹缝里：事故是真的，所以刹车是必要的；但手握刹车的，恰恰也是最想独占赛道、最擅长把“安全”变成准入门槛的那几家。真正的风险预警，必须落在对所有人一视同仁的规则里——而不是某些公司既当运动员，又当裁判，还负责给其他车手划线。
毕竟，和AI失控一样可怕的，是连“谁来踩刹车”这件事，都变成了竞争的一部分。
藻知科技评论员 罗亦丹
编辑 杨娟娟
校对 赵琳

[Оригинал](https://www.bjnews.com.cn/detail/1790570005129145.html)