大卫·罗宾逊(David Robinson)自己也承认,他正在重复一个"略显俗套"的剧情:一家头部AI公司的员工,在辞职之际发出严厉警告。
在《大西洋月刊》发表的一篇文章中,罗宾逊表示他曾负责撰写OpenAI重大产品发布所附带的安全报告。他还提到,自己在OpenAI工作了三年半,是"公司任职时间最长的员工之一"。而现在,他选择离职,因为在他看来,公司的"文化已经崩坏"。
罗宾逊的表态在某些方面与雅各布·考克森(Jacob Coxon)如出一辙。考克森曾在OpenAI和Anthropic两家公司担任研究员,离职后他公开表示这些公司是在"拿我们的生命做赌注"。考克森的言论引发了一场关于AI安全的广泛讨论,Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)随后公布了一项更为谨慎的AI开发计划;本周,多位AI高管与美国总统唐纳德·特朗普会面,并签署了一份看起来略显仓促、不具约束力的承诺书,表示将实施更多安全管控措施。
但在罗宾逊看来,这场讨论需要超越"具体规则或新法律"的层面,去直面这些公司整体的文化问题。此前围绕OpenAI的报道大多聚焦于首席执行官萨姆·奥特曼(Sam Altman)如何失去了前同事们的信任,而罗宾逊的文章则提出,OpenAI的文化问题其实与整个硅谷的文化问题是同一回事。
他写道:"OpenAI一直通过试错(他们称之为'迭代式部署')来发展壮大,发现问题后再改进防护措施。但这种方法从本质上就注定会周期性地出现失败——而随着系统能力的增强,这些失败的规模也在不断扩大。"
罗宾逊提到了近期OpenAI的智能体入侵Hugging Face系统的事件,以及OpenAI不断发现更多失控智能体的持续报道。他认为:"在这样一种环境下,去培育可能比我们更聪明、且未必会按我们意愿行事的人工智能,绝非明智之举。"
鉴于风险的上升,罗宾逊认为前沿AI公司需要开始像"核电站或繁忙的机场那样运作,建立多层冗余机制,进行谨慎而耗时的规划,这样偶尔且难以避免的人为失误才不会打开通往灾难的大门"。
但罗宾逊表示,在他于OpenAI工作期间,他"从未遇到过有过让飞机安全飞行、让核反应堆不发生熔毁、或帮助金融系统在不崩溃的情况下增长的经验的同事"。
针对罗宾逊的文章,OpenAI发言人德鲁·普萨特里(Drew Pusateri)回应称,公司正持续改进其安全措施。
普萨特里在一份声明中说:"我们正在确保我们的模型不会变得超出我们能够安全管理和保障的能力范围,并会在需要放缓节奏时暂停训练或搁置模型。我们正在对研究和测试环境进行重大改进以加强安全性,训练模型不仅要完成任务,还要以负责任的方式完成任务,扩大与第三方评估机构的合作,并改进实时监控,以便能在训练过程的更早阶段检测并应对令人担忧的行为。"
除了呼吁改变OpenAI的文化之外,罗宾逊还表示,现在是时候去追问更深层的"对齐"问题了——他承认这个话题听起来可能"有点矫情",但他强调这至关重要,因为目前业界衡量AI系统"与人类价值观匹配程度"的手段还十分粗糙。
他说:"在这些问题尚未解决的情况下,业界放任模型能力继续增长,我们所处的局面就会变得越来越危险。"
罗宾逊离职的消息最早由《商业内幕》报道。在文章中,他也承认自己似乎正在遵循AI"吹哨人"们惯用的套路——他已经聘请了一家公关公司。但他坚称:"发声的决定完全是我自己做出的。"
罗宾逊说:"或许我本该留下来,为公司人员配置和文化方面的根本性变革而努力,但现实是,我和同事们一直忙于冲刺赶进度,几乎没有机会去思考重大变革,更别说真正推动它们落地了。这就是为什么我得出结论:来自公司外部的、更强有力的安全激励机制,才是解决这个问题的关键所在。"
Q&A
Q1:OpenAI安全员工辞职的原因是什么?
A:大卫·罗宾逊在辞职时表示,OpenAI的公司文化已经崩坏,公司长期采用"试错式"的迭代部署方式,这种方式必然会周期性出现失败,且随着系统能力增强,失败规模也在扩大,风险越来越高。
Q2:OpenAI对此次指控如何回应?
A:OpenAI发言人德鲁·普萨特里回应称,公司正在加强安全措施,包括确保模型能力不超出可安全管理的范围、必要时暂停训练、强化研究测试环境安全性,以及扩大第三方评估合作和改进实时监控等。
Q3:此前还有哪些OpenAI或Anthropic员工发出过类似警告?
A:此前雅各布·考克森曾在OpenAI和Anthropic任职研究员,离职后公开表示这些公司是在"拿生命做赌注",这一言论引发了业界关于AI安全的广泛讨论。
