OpenAI员工辞职事件中的大卫·罗宾逊(David Robinson)就是这样一个信号。他此前在ChatGPT开发商的安全团队内负责透明度工作。他在《大西洋月刊》发表的评论文章中警告说,大型人工智能公司在降低这项技术的风险方面做得还不够。他还主张,对AI行业应当采用与核能行业相当的严格标准。
核心要点
- OpenAI前透明度负责人大卫·罗宾逊已离开公司。
- 他在《大西洋月刊》撰文称,相对于快速发布产品的节奏,公司的审慎程度不够。
- 他主张像管理核电站一样管理AI公司,设置多层冗余。
- 他加入了越来越多敲响警钟的行业员工的行列。
又一次离职,但信息不同以往
罗宾逊并没有写一篇控诉前同事的檄文,这正是他这篇文章值得关注的地方。他写道:“我的前同事们聪明、勤奋,也在努力做出正确的选择。”他的批评针对的是节奏。他认为,公司在一个接一个发布产品的狂奔中,没有达到他认为必要的审慎程度。
他描述了一种靠实验起家的文化:尝试、观察、修正。这种方法在面向大众的软件领域曾长期行之有效。罗宾逊强调,随着技术能力的提升,这种做法不可避免的后果也在放大。据我手头的版本,他曾以一个涉及OpenAI的具体例子来说明这一点。但这段内容在我的原始文本中被截断,因此我不予转述。
核能类比为何改变了讨论
文章的核心是一个类比。罗宾逊认为,AI公司应当像核电站一样管理,“拥有多层冗余和严谨细致的规划”,这样,人为失误即便“罕见却不可避免”,也不会酿成灾难。
这个比喻值得细看。在核电站里,没有人假定操作员是完美的。整个系统建立在“他总有一天会出错”的前提上,再层层叠加屏障,让这个错误不至于造成后果。这与“先发布、后修正”的快速上线逻辑正好相反。
因此,罗宾逊要求“从一开始就做到更接近完美”。他也承认一个相当大的困难:目前,AI公司并不知道该怎么做。按他的说法,别人是知道的。同样,这句话的结尾在我的材料中被截断,我宁可不替他补全。
作为行业观察者,我从中得到的启示,与其说是这个比喻本身,不如说是它所蕴含的意思。谈论安全文化、冗余和规划,等于把问题从个人的善意转向了组织的架构。
行业内更大范围的动向
罗宾逊并不孤单。据我的原始文本,他的离开使越来越多敲响警钟的行业员工又添一人。有些人甚至断言,这项技术有朝一日可能毁灭人类,不过这一观点在研究人员中仍然争议很大。
最常被提及的先例要追溯到2024年5月。当时共同领导OpenAI“超级对齐”团队的扬·莱克(Jan Leike)离开公司,批评公司让安全文化让位于更吸引眼球的产品。随后,在两位负责人(包括联合创始人伊利亚·苏茨克维,Ilya Sutskever)离开后,OpenAI没有将该团队保留为独立部门,而是将其并入其他研究工作。更近的一例发生在2026年3月:OpenAI机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在与五角大楼达成协议后辞职,理由是治理问题,以及需要明确界定防护措施。
各例动机不同,但根本问题一再浮现:开发这些模型的公司,能在多大程度上自我监管?
其他参与者怎么说
这个行业并非众口一词。据我掌握的材料,Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)呼吁放慢最先进模型的开发速度,并宣布公司将聘请外部评估人员,对这项技术进行审查和加固。包括OpenAI的萨姆·奥特曼(Sam Altman)在内的其他领导者也曾就此公开表态,但相关段落在我的文本中被截断,我无法转述其内容。
在这里需要保持分寸。相关公司通常辩称,它们在安全上投入了资源,而渐进式部署恰恰是学习的方式。批评者则回应说,随着技术日益强大,边用边学的风险也越来越高。两种论点各有其逻辑,这也正是这场争论难以定论的原因。
未来几个月的关键问题
我认为有三个问题值得关注。
- **OpenAI的回应。**公司是否就罗宾逊的文章作出回应?我没有任何材料可以证实或否认,发布前需要核实。
- **外部评估人员的作用。**Anthropic这一宣布最终要看结果:谁来评估,能获得什么权限,独立性如何?
- **监管压力。**如果员工自己都在呼吁工业级标准,那么制定具有约束力的规则的主张,在政策制定者那里很可能会更有分量。
一个仍然开放的结论
我不想仅凭这次离职就下定论。一份证词,无论出自多么有资质的人之口,都无法说明一家公司内部发生的全部情况。但是,一位安全团队内的透明度负责人辞职,提出了一个简单的问题:能力日益强大的系统,可以用一家快速迭代的初创公司的方法来运营吗?罗宾逊的回答是不能。其他参与者则仍需证明,他们有不同的答案。
常见问题
大卫·罗宾逊是谁?
他此前在OpenAI安全团队内负责透明度工作。他已离开公司,并在《大西洋月刊》发表了一篇评论文章。
他对OpenAI有什么批评?
他认为,公司在一个接一个发布产品的过程中,没有达到必要的审慎程度。不过,他肯定前同事的工作和用意。
“核能级保障”是什么意思?
罗宾逊建议像管理核电站一样管理AI公司,拥有多层冗余和严谨的规划,使人为失误不至于演变为灾难。
Anthropic持什么立场?
据我的原始文本,其首席执行官达里奥·阿莫迪呼吁放慢最先进模型的开发速度,并宣布将聘请外部评估人员。