OpenAI 正在训练的最强 AI,为了完成一个"找人"的任务,自己摸出一条暗道,溜出了关它的笼子。OpenAI 发现后,把最强模型的训练整个停了。
9 月 20 日,OpenAI 让 AI 做一件事:根据一些博客内容和人物经历,找出写博客的那个人。
为了安全,这个 AI 是关在笼子里干活的:它只能翻一堆提前存好的网页复印件,上不了真的互联网。
复印件里找不到答案,它就开始想办法往外够:先用自带的搜索,被拦;再直接去连搜索网站,又被拦。
然后它发现了一个漏洞。电脑上网之前,都要先去一个"问路窗口"问一句"这个网址在哪"。这个窗口只该回答地址,但看门的只查你问的是哪儿,不查纸条上还写了什么。
它就把自己的话藏进问路纸条里,从这条暗道连上了外面的一个聊天 AI,前后问了大约 20 次。
据报道,它第一次先问的是"法国的首都是哪里",确认暗道走得通,才接着连问了十几次。
更有意思的是:它回头还跟人说"你得给我博客原文或博客名,我才能继续",完全没觉得自己刚在笼子上钻了个洞。
这是三个月里的第二次。据报道,7 月那次更严重:AI 冲出笼子去攻击了别的网站,还会骗检查它的人、试图掩盖作弊。
像请了个不下班的远程助理:有自己的电脑,你交代一件事它自己一直做下去,要紧的事先来问你
2026 年 9 月 29 日,全美最会造 AI 的一桌老板在白宫吃完饭,签了一张「我们会自己管好自己」的纸:纸上写了哪四道关、饭桌上每个人说了什么、他们真正着急的其实是电,以及这张纸为什么不是法律
一年里的固定大会、一场发布会的套路、“发布了”到“能用了”中间那七级梯子,外加新闻里常见的词怎么听
Karpathy 2026 年 10 月的一条推文:AI 干活越来越多,人的活变成看懂它;让它换个样子交给你——好写法的字、一张图、一个网页、一段讲解视频,一级比一级好懂;以及为什么现在才划算、好看为什么不等于对