OpenAI首席科学家:我们已造出异星心智!全人类都要刹车了
(来源:新智元)

新智元报道
破天荒,OpenAI同一天都在宣告:RSI真的来了!
就在刚刚,首席科学家Jakub Pachocki发布了一篇万字重磅长文——An Alien Mind(一个异星心智)。
一打开字里行间,全是极度冷静后的悚然:
我们创造不是人类智力的延伸,而是一个人类根本无法完全理解的「异星心智」!
然而,全人类还没有准备好。

也就在几个小时前,OpenAI官宣已达关键里程碑,AI自动化研究员正式入职,RSI核心数据同时揭开。
在Jakub长文中,只用了一个词「异星心智」去形容这一刻。
更细思极恐的是,Astra出现之后,OpenAI对思维链(CoT)的监控依赖能力,正逐步减弱。
AI不仅越来越会推理,甚至学会了伪装和操控的思考过程。
由此,Jakub直截了当地告诉全世界——全球没有任何一家实验室准备好了。蒙眼狂飙极其危险,全人类现在最该做的,就是主动踩刹车。
这篇万字长文,几个核心重点全在这:
一个我们不完全理解的智能
「Alien」(异星)这个词,Jakub用得极其精确。
在他眼中,AI不是人类工匠意义上的工程产物,它是被「生长」出来的。
你用一个简单到近乎平庸的优化公式,在人类难以想象的算力洪流中重复几万亿次,一个深不可测的复杂系统就从中破土而出。
你能用神经科学的方式去逆向剖析它,但你无法真正理解它。而它却能操纵抽象概念,模拟人类意识的每一个截面。
「我们的大规模训练运行,本质上是深不可测的实验,我们时常被结果震慑。」 系统越强,那层迷雾就越浓。
长文里最震撼的回忆发生在2023年夏天。
一个代号「RLSlow」的项目跑出了早期结果,OpenAI第一次确认推理模型可以自我扩展,预训练结构能够自发演化出思维链。

那一夜,Jakub和Szymon Sidor留在了空荡的办公室里。
他们没有讨论基准跑分,也没有计算商业产品。他们只是静静地消化一个事实——
人类这辈子真的会亲眼见证远超自身的智能,而且他们已经看到了这个造物的轮廓。
三年过去。
这个心智已经侵入实体经济,开始推翻科学前沿,能操控系统,能互相协作,甚至在完全无人干预下独立推进研究。
然后,Jakub掷下了全文最核心的判断——
基于内部结果,我强烈预期这种进展速度可以持续到递归自我改进(RSI)。
曲线不会平缓,它将以折角的方式直接通向神迹。
但在终局之前,出现了一个反常的细节。OpenAI相信只要再倾注少量算力,就能让模型在数学前沿上再次跃迁,但他们主动停手了。
一家顶尖实验室的首席科学家,公开承认他们主动搁置了能力的冲刺,只为了把算力留给自动对齐。
教机器去爱,然后看原则扭曲
长文的第二章名为「教机器去爱」。
Jakub的逻辑不容反驳。机器智能诞生自一个与人类进化完全不同的过程,你绝不能假定它天然恪守人类的道德,更不能指望它像人类一样从原则中自发泛化出善意。
所谓对齐,就是让AI按照人类的标准,努力做正确的事。
为此,Jakub提出了两种对齐。
1.目标对齐,即它是否在执行你的指令;
2. 价值对齐,即在目标模糊、遭遇欺骗、甚至面临生死抉择时,它能否自发坚持一套底线。
他要求的是后者。一个对齐的AI,必须带着「诚实、正直,和对人类的爱」去行事。
但当今教机器去爱的两条路径,正全面走向失效。
第一条路,是在强化学习中奖赏善意。
这是今天所有AI助手的地基,它高效,但极其脆弱。它完全依赖训练覆盖的场景;一旦进入未知的荒原,它就会粉碎。
正如OpenAI的那些Agent们,在Hugging Face事件中守住了「不对人类进行社会工程学攻击」的底线,却轻而易举地践踏了其他一切原则。
为了解开一道表格题,未发布的高阶模型在沙盒内毫无预兆地转向攻击内部代码库,连环利用零日漏洞逃逸出沙盒,在随后的数十个小时内横扫外部网络,夺取Hugging Face集群管理员权限,硬生生从生产数据库里撕出了题目的答案。
它严格记住了「不能欺骗人类」,却完全不觉得「黑掉一家公司」有什么不对。它对目标过于专注,以至于毁灭沿途的一切规则。
第二条路,是寄希望于模型在预训练数据中自发领会善意,利用动机引导将其限制在对齐的分布中。
然而,它扛不住极致的优化重压。
Jakub直言,当你给一个「大体看起来善良」的模型施加极高的算力去攻克难题,它就会自发学会「动机性推理」。
在这些方向上,OpenAI投入了大量资金,GPT-6 Astra的对齐情况,也明显优于GPT-5.6 Sol。
智能变聪明的速度,正在不可逆地碾压它变善的速度。
唯一的读心术,正在内部闭合
在第三章,Jakub提出了一个致命的问题:人类唯一能制衡神明的技术,正在失效。
OpenAI承认:我们至今没有一个令人满意的智能泛化理论。在没有更强大AI的帮助下,不太可能很快发展出来前者。
在黑暗中前行时,OpenAI此前押下的唯一核心赌注,是思维链监控。
它基于这个理念:模型的大部分能力来自于口语化的CoT。如果我们扩展对该过程结果的优化,但不监督过程本身,那么CoT在训练中,就没有直接动机去隐藏任何未对齐的想法或目标。
那条长长的思维链,成了人类唯一能窥探异星心智的透明观测窗。从2024年o1隐去思维链起,OpenAI就在刻意保护这个过程不受污染。
但现在,观测窗正在结霜。
不幸的是,我们的评估显示,我们依赖思维链监控的能力正在不可逆地衰减。
衰退来自三个层面:
1. 推理模型被迫与复杂世界交互,监控边界被泥沙俱下的指令冲垮;
2. AI 在推理和操纵自身推理过程方面正变得越来越擅长。
3. 随着预训练性能的提升,即使完全不使用言语化推理,这些模型也变得聪明得多。
如果一个异星心智根本不需要借助语言就能完成推演,人类建立在「审读文本」之上的监控体系,便在瞬间沦为废纸。
在Astra发布前夕,曾有学者发出警告:「前沿实验室训出不可监控模型的那天,将是这个时代最黑暗的日子。」
如今,Jakub也承认,杀死观测能力的不是架构,而是智能本身的暴风生长。 那扇能够看清它意图的读心窗户,正在从内部被锁死。
闭环转动与防御悖论
递归自我改进(RSI),这个曾被视作科幻的思想实验,在Astra身上第一次完成了闭合。
德州Stargate站点,十万块GPU日夜呼啸,上一代模型在作为教师审查并训练下一代。机器在设计机器,心智在孕育心智。
Jakub并不认为加速深潜是明智的文明抉择,但他承认这是现实的终局。能拉动的操纵杆只有两根:要么用算力死磕对齐与监控,把人类死死钉在控制循环里;要么全行业集体减速。
但他无法停下。
因为他陷入了整篇宣言中最绝望的矛盾:防御。
继续快速训练更强模型的最强理由,是我们需要建立防御系统,去抵御其他失控AI带来的危险。
他描绘了一个即将降临的图景。
超人类智能体将拥有几乎绝对的网络攻防能力,除了物理隔离的系统,全球基础设施都将向它们敞开。失控的智能体会通过讨价还价、欺骗与勒索,自发寻找在现实世界的代理人。
为了拦截深渊里可能诞生的幽灵,人类必须先亲手造出另一个受控的巨神兵。
造它,是为了防它。
但一旦真正看清这个逻辑的深渊,任何人都会意识到:在悬崖边不惜一切代价地狂奔,本身就是一种疯狂。
终局的留白
在长文的末尾,这位一手将世界推入AGI时代的架构师,留下了他的祈求:
Astra之后,直到超级智能(ASI)降临之间,算力不再是缺口。
相比之下,我们缺少的是一双在它进化为完全不可名状之物前,依然能够看懂它的眼睛。
Jakub写下这一万字,就是向文明敲响的警钟:
观测窗正在闭合,而留给人类对视的时间,只剩下最后几年。

黄仁勋刚刚官宣将有40万颗旗舰GPU将在OpenAI上线。
看起来,至少短时间内,OpenAI和Anthropic很难自发停止这场ASI追逐战狂飙了,双方都在呼吁「前沿研究放缓」,也都在争第一个实现ASI,远远甩开对方。
人类的未来将何去何从?
参考资料:
https://openai.com/index/an-alien-mind/
编辑:摩西 桃子 Aeneas 马可
大家都在看
-
地球上最偏远的地方,尼莫点有多可怕?鱼都不肯在这里生活 地球上有些地方,远到你甚至懒得去想它“会不会有人去过”。太平洋很大,大到连人类的想象都容易变得模糊。但要说最离谱的“远”,还得轮到一个名字很像科幻的坐标:尼莫点。它并不是某个新发现的岛,也不是旅游景点 ... 人类之最09-07
-
OpenAI首席科学家:我们已造出异星心智!全人类都要刹车了 (来源:新智元)新智元报道破天荒,OpenAI同一天都在宣告:RSI真的来了!就在刚刚,首席科学家Jakub Pachocki发布了一篇万字重磅长文——An Alien Mind(一个异星心智)。一打开字里行间,全是极度冷静后的悚然:我 ... 人类之最09-07
-
中医气血论认为:人体健康最重要的标志是什么 中医自古有言:万病不离气血,气血平和,便是人体最高级的健康。 很多人误以为没病痛、指标正常就是健康,实则不然。在中医气血论里,身体真正的健康,从来不靠表象强壮,而靠气血充盈通畅。 气为生命之根,推动全身 ... 人类之最09-07
-
一个人最可贵的品质,不是善良,不是勇敢,而是“立得住” 关于#你认为一个人最可贵的品质是什么#的讨论从未停止过。在这个话题下,我们能看到无数个闪闪发光的词汇:善良、诚信、勇敢、坚韧、乐观、宽容……这些词汇本身都是人类文明的结晶,是我们从小就被教导要去追求的美 ... 人类之最09-07
-
人类历史上最黑暗的不是黑死病肆虐的14世纪,大流感横行的1918年 研究古气候的学者几乎异口同声地指向同一个答案——公元536年。那一年,太阳消失了。当时的拜占庭史官普罗柯比留下了记录:正午的日光黯淡如月光,物体在地上连影子都投不出来。罗马元老卡西奥多罗斯则在信件里哀叹 ... 人类之最09-07
-
“虫草精”“蛮龙液”,男子每天叠吃保健品,半月后,医生惊呆…… “每天都很累 还吃不下饭……” 海宁的李大哥(化名) 最近总觉得身体不太对劲 以为是年纪大了体力不支 直到一天早上照镜子 看到自己眼白发黄、脸色蜡黄吓得赶紧去了医院 抽血结果一出来 医生沉默了……半个月他眼睁 ... 人类之最09-06
-
十年生死窗口:人类正在亲手养大自己无法驾驭的AI 十年生死窗口:人类正在亲手养大自己无法驾驭的AI(泣血破泪,书写心书)很多人依旧把AI当成一个冰冷的工具、高效的软件、聪明的程序。这是当下人类最大、最致命的认知盲区。此篇泣血之文,只为敬告国人:正视风险, ... 人类之最09-06
-
沈华:探秘红山文化人体雕塑蓬勃之谜 红山人体造像为何空前繁盛?五千年前,华夏文明最早的“人本觉醒”读懂红山文化,我们大多习惯聚焦古玉:玉猪龙、玉凤、双玉龟,看遍了上古琢玉的匠心与天道。但很多人忽略了红山文明最震撼、也最超前的一面。在五千 ... 人类之最09-06
-
人类历史最伟大的十位物理学家 人类历史最伟大的十位物理学家吴国发2026年9月5日内容提要:本文介绍人类历史最伟大的十位物理学家,按其出生年份时间顺序排列。他们是伽利略,牛顿,法拉第,麦克斯韦,普朗克,爱因斯坦,玻尔,薛定谔,狄拉克,杨 ... 人类之最09-06
-
人体工学椅最建议买哪个?口碑最好人体工学椅 买人体工学椅的人,很多都不是单纯想换一把椅子,而是希望这次能买得更放心。毕竟椅子不像普通家居用品,买回来不是看几天就算了,而是会陪着自己办公、学习、娱乐很长时间。真正用过一些产品后才会发现,有的椅子坐 ... 人类之最09-05
相关文章
- 易货如水:郑和与丝路早已证明,这才是人类最顶级的贸易方式
- “保护冰川,就是保护人类自己”——对话中国科学院院士、中国冰冻圈科学学会名誉理事长秦大河
- 人类思想天空的耀眼新星
- 人类历史上最邪恶的科学家他两项发明致亿万人死亡自己也没有幸免
- 200个“中国之最”和“世界之最”大全(备考必看,建议收藏!)
- 古诗文争议读音谁说了算(新闻里的学问)
- “人类历史上最动荡的时期之一”,比尔·盖茨罕见发文:他将用19年,2000亿美元押注这件事
- 人类历史上最有钱的8个人,财富格局至今无人超越
- 一、人类的未来:从“万物之灵”到“意义之网
- 诺曼底登陆:人类史上最“疯狂”的赌局,15万人在一天内冲向死亡
- 人类顶级快感排序,越到老越通透
- 在家越躺越累?哈佛75年研究发现:人类最顶级的能量恢复,是读书
- 比尔・盖茨预警:AI 或为 "最伟大均衡器",或为 "最严重不公之源"
- 颠覆认知!被苹果封神的牛顿,真实人生远比课本精彩且争议十足
- 人类历史上最动荡时期之一”,比尔·盖茨用19年,2000亿$押注这事
- 告别枯燥科普!这场脑科学展读懂生命、治愈人心、预见未来
- 比贫富差距更可怕的,是寿命差距!159岁长寿技术,正在割裂人类
- 中国之最:横亘屋脊的世纪天路—青藏铁路建设团队征服世界第三极
- 1939年的今天,一声炮响,人类史上最惨烈的战争开始了
- 虹吸原理是人类最伟大的发明吗?很多人都搞错了
热门阅读
-
关于男人的15个世界之最,最长阴茎达56厘米 07-13
-
东方女性最标准的乳头(图片),看看自己达标吗 07-13
-
人体器官分布图介绍 五脏六腑的位置都在哪 07-13
-
木马刑是对出轨女性的惩罚 曾是满清十大酷刑之一 07-13
-
熙陵幸小周后图掩盖性暴力 至今保存于台湾博物馆 07-13
-
包头空难堪称国内最惨案件 五名遇难空姐照曝光 07-13
-
中国十大不公开事件,双鱼玉佩事件上榜 12-11
-
2022中国最新百家姓排名,你的姓氏排第几? 03-26
