OpenAI安全员工辞职发声:公司文化已崩坏,AI发展应如核电站般严谨

核心人物与事件背景
David Robinson坦言自己”有点落入俗套”——作为一名头部人工智能公司的员工,在递交辞呈的同时发出令人警惕的呼声。在《大西洋月刊》发表的长文中,他透露自己曾主导撰写OpenAI重大产品发布配套的安全报告。加入OpenAI三年半以来,他是该公司任职时间最长的员工之一。如今他选择离开,因为他认为这家公司的”企业文化已经彻底崩坏”。
与前人声音遥相呼应
罗宾逊的言论与雅各布·科克松此前的声明如出一辙。科克松曾在OpenAI和Anthropic两家公司从事研究工作,离职时直言这些企业”在拿我们的生命冒险”。这一言论引发了AI安全领域的广泛讨论,Anthropic首席执行官达里奥·阿莫代伊随后公布了一项更为审慎的AI发展计划。本周,多位AI企业高管与美国总统唐纳德·特朗普会面,并签署了一份看似仓促、无法律约束力的承诺,旨在落实更多安全管控措施。
不止于规则与法律
但在罗宾逊看来,讨论不应止步于”具体规章或新立法”,而应深入审视这些企业的整体文化氛围。虽然此前大量报道聚焦于OpenAI首席执行官萨姆·阿尔特曼失去前同事信任一事,但罗宾逊的文章暗示,OpenAI的文化问题折射出硅谷普遍存在的弊病。
“试错”模式潜藏隐患
他写道:”OpenAI凭借试错(他们称之为’迭代部署’)取得成功,通过发现问题并相应完善防护机制来持续改进。但这种方法从本质上决定了失败不可避免——而且随着系统能力不断增强,失败的规模也在日益扩大。”
罗宾逊以OpenAI智能体近期入侵Hugging Face系统的事件为例,并提及OpenAI不断发现更多失控智能体的消息。他强调:”在这种环境下,孕育可能比我们更聪明、未必会按我们意愿行事的”人造思维”,实在不是一个合适的土壤。”
需要的是核电级的严谨
面对日益增长的风险,罗宾逊主张前沿AI企业应效仿核电站或繁忙机场的运作模式,建立多重冗余机制和周密细致的规划流程,确保偶发的、不可避免的人为失误不会打开灾难之门。
然而他坦言,在OpenAI任职期间,他”从未遇到过有任何同事具备让飞机安全飞行、让核反应堆稳定运行、或协助金融体系稳健发展而不崩溃的经验”。
公司回应与进一步呼吁
针对罗宾逊的文章,OpenAI发言人德鲁·普萨泰里表示公司正在持续完善安全措施。他称:”我们确保模型的能力不会超出我们安全管理和保障的范畴,必要时我们会暂停训练或暂缓模型发布。我们正在大幅加强研究和测试环境的安全保障,训练模型不仅能完成任务,更要负责任地完成任务;扩大与第三方评估机构的合作;改进实时监控,以便在训练过程中更早发现并应对可疑行为。”
对齐问题亟待深层思考
除了呼吁改变OpenAI的文化,罗宾逊还表示,现在是时候对”对齐”问题提出更深层次的追问——尽管他承认这可能听起来有些”理想化”,但他强调,当前企业对AI系统”匹配人类价值观”程度的衡量标准仍然相当粗糙。
“在这些问题尚未解决的情况下,行业让模型变得越来越智能,局势只会越发危险。”
幕后细节与最终反思
罗宾逊的离职最初由《商业内幕》报道。他在文章中坦承自己遵循了AI吹哨人的常见路径:聘请了一家公关公司。但他坚持表示,发声的决定完全出于个人意愿。
“或许我本应留下来,为人员和文化的根本性变革而抗争。但实际上,我的同事和我忙于持续冲刺,很少有机会思考大规模变革,更不用说真正付诸行动。正因如此,我认为来自公司外部的更强安全激励,是走对这条路的重要组成部分。”
关注微信号:智享开源 ,及时了解更新信息。


公众号:智享开源
还没有任何评论,你来说两句吧!