David Robinson自己也承认,自己“有点像个老套的例子”:一名在领先AI公司任职的员工,在辞职时发出严厉警告。
Robinson在《大西洋月刊》发表的一篇文章中说,他曾负责撰写伴随OpenAI重大产品发布的安全报告。他还表示,在OpenAI工作了三年半后,他“是公司任职时间最长的员工之一”。如今他决定离职,因为在他看来,公司“文化已经失灵”。
在某种程度上,Robinson的说法呼应了Jacob Coxon的观点。Coxon曾先后在OpenAI和Anthropic担任研究员,后来辞职并宣称这些公司“在拿我们的生命赌博”。Coxon的言论引发了更广泛的AI安全讨论,Anthropic首席执行官Dario Amodei随后公布了一项更谨慎推进AI发展的计划;本周,AI高管还与美国总统唐纳德·特朗普会面,并签署了一份看起来是匆忙起草、且不具约束力的承诺,表示将实施更多安全控制。
但在Robinson看来,这场讨论需要超越“具体规则或新法律”,转而关注这些公司的整体文化。虽然围绕OpenAI的许多报道都集中在公司首席执行官Sam Altman如何失去前同事的信任,但Robinson的文章认为,OpenAI的文化问题与整个硅谷的问题如出一辙。
“OpenAI通过试错而蓬勃发展(他们称之为‘迭代式部署’),寻找问题并在出现问题后改进护栏,”他写道。“但这种方法从本质上保证了周期性失败——而随着系统能力越来越强,这些失败的规模也在扩大。”
Robinson提到,OpenAI代理近期入侵Hugging Face系统,以及OpenAI不断发现更多失控代理的情况,并表示:“一个会发生这类事情的环境,不适合孕育可能比我们更聪明、而且未必会按我们意愿行事的人工智能。”
鉴于风险上升,Robinson认为,前沿AI公司需要开始像“核电站或繁忙机场”那样运作,采用多层冗余和谨慎、耗时的规划,以免偶发且不可避免的人为错误打开灾难之门。
不过Robinson说,在OpenAI任职期间,他“从未遇到过有制造飞机安全飞行、让核反应堆在不熔毁的情况下运行,或帮助金融体系在不崩溃的情况下增长经验的同事”。
针对Robinson的文章,OpenAI发言人Drew Pusateri表示,公司仍在持续改进安全措施。
“我们正在确保我们的模型不会变得比我们能够安全管理和保护的程度更强;当我们需要放慢节奏时,我们会暂停训练或暂缓模型发布,”Pusateri在一份声明中说。“我们正在进行重大调整,以加强研究和测试环境中的安全性,训练模型不仅要完成任务,还要负责任地完成任务,扩大与第三方评估机构的合作,并改进实时监控,以便我们能在训练过程中更早发现并应对令人担忧的行为。”
除了呼吁OpenAI改变文化之外,Robinson还表示,现在是时候提出更大的对齐问题了——他承认这听起来可能有些“软绵绵”,但他说,在公司目前衡量AI系统“与人类价值观匹配程度”的方式仍然粗糙的情况下,这一点至关重要。
“行业允许模型在这些问题尚未解决时继续变得更聪明,情况就会变得越危险,”他说。
Robinson的离职最早由Business Insider报道。他在文章中还承认,自己遵循了AI吹哨人常见的一步:雇了一家公关公司。但他坚持说:“发声的决定完全是我自己的。”
“也许我本该留下来,为人员配置和文化的根本性转变而斗争,但实际上,我和同事们一直忙着冲刺,很少有机会去认真考虑重大改变,更别说真正去实现它们了,”Robinson说。“这就是为什么我得出结论:来自公司外部的、更强的安全激励,是把这件事做对的重要一环。”











