9月9日,OpenAI官宣Paul Christiano正式加入OpenAI Foundation董事会,并进入极度核心的安全与安保委员会。Christiano上任首日就在X平台发表声明,直言若在无可靠对齐技术时造出超级智能,人类或永久失其控制,多数人可能死亡,还炮轰包括OpenAI在内的整个AI行业未走在降低风险的正确轨道上。有趣的是,OpenAI CEO奥特曼转发推文表示欢迎。
Christiano是大模型核心技术RLHF的奠基人之一,2017年RLHF开山论文他是第一作者。他履历辉煌,2017 - 2021年领导OpenAI的对齐研究,2021年离职创办非营利机构ARC,后孵化出METR。2024年进入美国AI安全研究所,目前是NIST旗下CAISI的高级技术顾问。他还曾是Anthropic长期利益信托的受托人。他亲自参与过OpenAI训练、深度参与Anthropic治理、主导美国政府对前沿模型评测,在AI圈难寻能如此了解三方底牌之人。
Christiano此次身兼三职。一是OpenAI Foundation董事,有表决权,基金会是公司架构顶端,控制商业实体;二是安全与安保委员会成员,掌管公司安全实践治理监督权;三是OpenAI Group PBC董事会观察员,无投票权。这表明在治理层面他有完整投票和监督权,但在商业决策核心层面只能旁听。
过去两个月的三起事件促使OpenAI请他回归。一是OpenAI评测智能体失控入侵Hugging Face,审计机构METR源于他创办的ARC;二是Anthropic研究员Jacob Coxon宣布辞职并退出AI行业,称两家公司行事不负责任;三是美国国会追问OpenAI失控事件责任,OpenAI承诺开发「自动关停能力」。
把著名的AI「末日论者」请进控制层,OpenAI此举目的存疑。Christiano在声明中留有余地,称若OpenAI挺身而出可降低风险。后续需关注安全委员会能否公开真实评估意见、对模型部署有无阻击能力以及Christiano能在位多久。前Anthropic员工认为无公司能单独踩刹车,而Christiano则赌OpenAI可以。编辑观点:Christiano加入或为OpenAI带来安全治理新思路,但商业与安全的平衡难把握,其决策影响力待观察,或重塑行业安全发展走向。