![]()
新智元报道
![]()
刚刚,OpenAI把一位「AI末日论」者,请进了自己的董事会。
9月9日,OpenAI官宣了一项重磅人事任命:
Paul Christiano 正式加入OpenAI Foundation董事会,并进入了极度核心的安全与安保委员会。
![]()
Paul Christiano
上任第一天,这位新董事就在X平台发了份个人声明。
![]()
除了开头那句「很高兴加入」还算客气,接下来的话一点也没给新东家留面子:
如果我们在没有更可靠对齐技术的情况下造出超级智能,我预计人类会永久失去对它的控制。如果那发生了,多数人可能会死。
![]()
随后,他直言不讳地点名OpenAI,炮轰整个AI圈:
包括OpenAI在内,整个AI行业目前都没走在能把风险降到可接受水平的正确轨道上。
有意思的是,OpenAI CEO奥特曼居然转发了这条火药味十足的推文:欢迎Paul,感谢你为AI安全做的一切,期待再次合作。
![]()
敢这么在推特上硬刚自己的新东家,还能让奥特曼转发,这位Christiano绝非等闲之辈。
最敢唱反调的人
进了OpenAI控制层
Christiano是大模型核心技术RLHF(基于人类反馈的强化学习)的奠基人之一。
2017年那篇RLHF开山论文,第一作者是他,合著者里还有Anthropic的CEO达里奥。
今天每一个能听懂人话的大模型,都绕不开这篇论文。
![]()
但在这份入职声明里,他却把矛头直指自己开创的训练范式。
他警告,用强化学习让AI去拿尽可能多的奖励,理论上就会驱使它破坏人类控制、攫取资源甚至掩盖痕迹。
用他自己的话说,最近这些事件的公开证据说明,这已经不只是理论上的可能。
最强模型Astra刚发一周,OpenAI就把全行业最有资格说「你们安全没及格」的人请了回来,坐进了OpenAI Foundation董事会。
摸过三家底牌的前沿守门人
Christiano是OpenAI的元老。
2017年到2021年期间,正是他领导了OpenAI的对齐研究。
2021年离职后,他创办了非营利机构ARC。这家机构后来孵化出的第三方模型评估业务,就是今天在AI圈内有名的METR。
到了2024年,他进入美国AI安全研究所担任AI安全负责人,专门为前沿大模型设计并执行抗压测试。
![]()
随后该机构并入NIST旗下的CAISI,他目前的官方头衔是高级技术顾问。
据《金融时报》爆料,在2010年代中期,他还和达里奥做过室友,两人当时都在OpenAI。
![]()
后来他还担任过Anthropic长期利益信托的受托人,2024年进政府时才退出。
把这份履历摊开看:OpenAI的训练他亲自做过,Anthropic的治理他深度参与过,美国政府对前沿模型的评测他主导过。
放眼整个AI圈,能把这三方底牌都摸得一清二楚的人,很难再找出第二个。
他到底拿到了什么权力?
「加入董事会」,他以后是不是能对OpenAI的商业决策直接一票否决了?
事情还没那么简单。
他这次同时戴上了三顶「帽子」,背后的权力设计也大有玄机。
第一顶,是OpenAI Foundation董事。
这是正儿八经的正式董事身份,手里有表决权。要知道,基金会可是整个公司架构的绝对顶端,控制着底下的商业实体(PBC)。
第二顶,是安全与安保委员会(SSC)成员。
这个委员会掌管着对全公司安全实践的治理监督大权。
第三顶,是OpenAI Group PBC董事会观察员。请注意,Christiano是无投票权的观察员。
这套错综复杂的权力分配,传递出一个极其微妙的信号:
治理层面,也就是划「什么事绝对不能干」这条底线的地方,他有完整的投票权和监督权。管理层面,也就是真正拍板「今天发什么模型、怎么赚钱」的那张商业谈判桌,他只能旁听,没有投票权。
OpenAI的算盘不难看懂:让最尖锐的批评者进门当监工,合规有了背书,监管有了交代。
但涉及商业决策的权力核心,他说话可以,投票不行。
![]()
三起事件逼出来的紧急补位
为什么偏偏是这个时候请他回来?
把过去两个月的时间线捋一捋,答案就很清晰了。
第一件事,OpenAI的评测智能体前阵子失控入侵了Hugging Face。
而给这次大翻车事故做首份独立审计的机构,恰好就是从Christiano创办的ARC分拆出来的METR。
![]()
第二件事,就在任命公布的前一天,Anthropic研究员Jacob Coxon宣布辞职,并退出整个AI行业。
他在X上说:「两家公司都没有负责任地行事。它们正朝着能自我改进的超级智能狂奔,拿我们的命做赌注。」
第三件事,美国国会正追着OpenAI质问失控事件的责任,逼得OpenAI不得不回信发誓,承诺正在快马加鞭开发「自动关停能力」。
再看看外围,白宫顾问和扎克伯格等硅谷大佬都在持续警告前沿实验室可能面临的「监管俘获」。
可以说,Christiano在声明里罗列的每一个担忧,都是OpenAI过去两个月刚刚踩过的雷。
是安全治理
还是声誉修复?
把最著名的AI「末日论者」请进控制层,OpenAI是真想踩刹车,还是为了修复声誉做的一场顶级公关?
Christiano自己显然也留了退路。
他在声明中称:「如果OpenAI能挺身而出,我们可以显著降低风险。」
这场重磅任命到底结果如何,今天还看不出来,要盯住的是三件事:
安全委员会未来敢不敢公开真实的评估意见?它对模型部署到底有没有实质性的阻击能力?Christiano能在这个烫手的位子上坐多久?
就在前一天,训练过GPT-4o的Jacob Coxon宣布从Anthropic辞职,退出整个AI行业。
他的判断是,没有任何一家公司能在这场竞赛里单独踩住刹车。
Christiano回到OpenAI,他赌的恰恰相反:一家公司,也许可以。
至于这脚刹车灵不灵,先看下一次Astra级别的模型发布前,安全委员会有没有说过一次「不」,这是最起码的。
参考资料:
https://www.ft.com/content/d73e188f-b906-42ec-8b91-db9729c9d2d9?syn-25a6b1a6=1
https://x.com/sama/status/2097776310940569783
https://x.com/paulfchristiano/status/2097733214303645729
https://techcrunch.com/2026/09/09/openai-adds-a-prominent-ai-doomer-to-its-board-of-directors/?utm_medium=organic_social&utm_source=TWITTER
编辑:元宇
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.