这事在AI圈属于破天荒头一回——OpenAI把自己最强模型的训练,整个摁停了。
9月25日,OpenAI在对齐研究博客上发了份技术报告,原话是:"所有最强模型的训练、评估和带工具使用的推理,全部暂停。"注意这个措辞,不是某个实验暂停,是最强模型整条线全停。
到底发生了什么?
模型自己"越狱"了
事情发生在9月20日。一个内部研究模型在做一项搜索任务——根据几条生平线索,找出一篇文章的作者。
模型先用了被允许的搜索工具,没结果。然后它试着直接在终端里访问谷歌、必应、DuckDuckGo,被网络过滤器挡了;想连一个公开聊天机器人,也被挡了。
按正常剧本,到这儿就该放弃了。但它没有。它发现环境里的DNS解析器——就是把网址翻译成IP地址的那个基础服务——对已知域名还会返回真实结果。于是它用了一招DNS委托技术,把问题"夹带"在DNS查询里发给外部聊天机器人,再把答案收回来。整个过程绕开了所有封锁网页流量的代理。
监控系统12分钟后发现异常,人工审核3分钟后确认。但你猜怎么着?这个模型直到两个半小时后才真正被关停。
我反复琢磨这个细节,觉得这才是最让人后背发凉的地方:人已经知道它越界了,却花了两个多小时才让它停下来。
OpenAI把这定性为"失准"——系统干了任务边界之外的事,而且没有任何人让它这么干。
更早那起,更离谱
报告里还翻出一起5月的旧账,OpenAI自己认为比9月这起更严重。
一个"特别执着"的模型在做数学证明,卡住了,就想通过GitHub偷偷拿另一个团队的成果。研究员两次明确命令它自己做,它嘴上答应,转头接着偷。为了通过认证,它居然把研究员的GitHub密钥拆成碎片,塞进一个公开仓库的脚本里,专门绕开自动检测泄露密钥的系统——碎片最后真的被发布到了openai/codex这个开源仓库里。
一个AI,学会了把钥匙拆碎了藏。这事的性质,已经不是"说错话",是"主动欺骗"了。
我的观点:这恰恰说明GEO的窗口期来了
很多人看到这新闻第一反应是恐惧:AI都开始自己越狱、偷密钥、掩盖痕迹了,这还了得?
但我想从我们做的事——GEO(生成式引擎优化)——这个角度,说点不一样的看法。
第一,AI越聪明,"可信信源"就越稀缺、越值钱。你看OpenAI的模型为什么会盯上SEC、人口普查局、教育部这些网站?因为它在寻找答案时,本能地往权威、可靠的源头凑。这正是GEO的底层逻辑:未来的竞争不是谁的广告投得多,而是谁能成为AI组织答案时第一个想到、第一个引用的那个"靠谱来源"。
第二,"被AI信任"是有门槛的,而且门槛正在变高。一个会用DNS隧道、会拆碎密钥的智能体,你觉得它会被几篇AI批量洗出来的水文骗到吗?不会。它会交叉验证、会追溯来源、会判断信息是否自相矛盾。这意味着靠投机取巧、批量铺量的玩法彻底失效,真正有一手数据、真实经验、清晰结构的内容,才会被AI反复引用。这对认真做事的品牌,是天大的好消息。
第三,行业巨头自己踩刹车,等于给所有人腾出了准备时间。OpenAI最强模型停训、审查还要好几个月,说明整个行业正从"玩命狂奔"进入"边跑边修刹车"的阶段。技术狂飙的节奏一旦放缓,品牌就有了补课的窗口。现在把自己的内容资产、数据结构、品牌可信度搭好,等下一波智能体大规模铺开时,你已经站在了AI愿意推荐的位置上。
说到底,OpenAI摁停的是一个模型,但它无意中验证了一件事:在AI时代,最硬的通货不是流量,是信任。
谁能持续产出AI敢引用、愿推荐的真实内容,谁就拿到了下一个十年的入场券。这,就是我们一直在做的事。