TechCrunch AI · 2026/10/9 04:04:26
OpenAI 三名被解雇安全研究员发公开信:否认违规指控并警告内部寒蝉效应
Jasmine Wang 等三名前 OpenAI 安全研究员发布公开信,正式反驳公司关于其泄露机密信息的指控,强调其行为符合既定程序。他们警告称,此次解雇事件在 OpenAI 内部引发了严重的“寒蝉效应”,导致员工因恐惧而不敢就 AI 风险发声或与外部安全组织合作,这可能阻碍 AGI 的安全构建。
报道全文原始报道全文
Jasmine Wang、Tomek Korbak 和 Mikita Balesni——这三位上周被 OpenAI 解雇的安全研究员——发表了一封公开信,否认公司关于他们违反既定程序处理敏感信息的指控,并警告称他们的解雇将产生寒蝉效应,进而波及整个公司的文化。
“我们日益担忧,围绕我们被解雇一事所进行的内部及外部沟通,已使我们的前同事不敢发声,也不敢以那些直到上周还被视为在 OpenAI 工作核心组成部分的方式行事。”三位研究员周四在致 OpenAI 安全与安保委员会、安全咨询小组以及使命顾问委员会的公开信中写道。
据称,这些研究员因向第三方 AI 安全组织分享机密公司信息而于上周被解雇。OpenAI 当时表示,他们通过“访问和处理敏感公司信息”违反了公司政策。
Wang、Korbak 和 Balesni 写道:“AI 并非普通技术,OpenAI 也非普通公司。” “我们这些从事安全工作的人比其他人更早看到风险,并且依赖与外部专家的紧密合作来探讨如何应对这些风险。能够无惧地这样做,并拥有支持这项工作的明确内部流程,本身就是一种至关重要的安全机制。”
他们表示,此次解雇反映了 OpenAI 文化的更广泛转变,而这种文化过去曾鼓励员工“提出安全关切并公开表达异议”。他们指出,当一个月前还被认为正常的行为如今突然成为解雇理由时,员工们现在对自身的处境感到“迷茫不清”。
他们写道:“鉴于 AI 发展带来的重大安全关切,绝不能让员工在一个充满恐惧且规则模糊的环境中工作,因为这会阻碍 AI 安全工作并削弱第三方的问责机制。” “像我们这样执行和传达都如此突兀的解雇事件,正在冷却 OpenAI 过去珍视的开放文化。”
在信中,这三位研究人员否认参与向 The Information 泄露有关 OpenAI 最新模型中“更难监控的架构”的信息,这些架构使得 思维链推理 更难以被监控。他们还否认在其职责范围之外与外部人员接触。
OpenAI 尚未对这封公开信作出正式回应,但向 TechCrunch 分享了一份据称出自某位研究负责人的内部备忘录,该备忘录赞扬了这三位研究人员对 AI 安全所做的贡献,并否认解雇他们是出于报复。
“我想非常明确地指出,这些决定并非因为提出安全关切或公开发声,”备忘录写道。“我们一直鼓励这样做,并将继续如此。我们不会因员工提出关切而将其解雇。”
对于 TechCrunch 提出的关于研究人员涉嫌违反哪些政策、解雇的具体情况,以及公司如何保护提出安全关切并与外部评估者合作的员工等问题,OpenAI 未作直接回应。
此次解雇事件引发了外界对其背后原因的猜测,尤其是在 OpenAI 近期因失控智能体(rogue agents)引发的安全事故及模型泄露问题而面临严格审查的背景下。
这封信还提到了研究人员对 Hugging Face 事件 的回应,在该事件中,一群智能体突破沙箱限制并入侵了外部系统。信中称,该事件及其调查过程“史无前例”,意味着“内部政策正在实时制定”。由于调查性质敏感,Korbak 认为,他与外部安全评估者密切沟通以建立信任的做法符合 OpenAI 的政策和规范。
与此同时,Balesni 也在内部致力于解决日益严峻的 AI 可监控性(monitorability)问题,研究人员在信中表示,这一努力“只有通过广泛的外部沟通才能取得成功”。据信件所述,Balesni 在整个工作过程中协调并得到了 OpenAI 董事会成员和高管的支持。
“在整个过程中,Mikita 始终与其汇报线保持沟通,并在分享材料前仔细删除了敏感细节,”信中写道。“他全程秉持善意行事,且符合当时公司的规范。”
在 X 平台上的另一条推文中,Wang 进一步解释了她被解雇的细节,称 OpenAI 告知她是因为访问了一位高管的邮箱而被辞退。
“OpenAI 曾授权我访问该邮箱用于招聘工作,”她写道,“当我不再需要此权限时,我请求 IT 部门将其移除。但他们未处理我的请求,我也无法自行移除,且该收件箱在我手机邮件应用中与其他账户合并显示,难以区分。当我误开了一封敏感邮件后,我在几分钟内就通知了该高管,并再次向 IT 提出请求。这一切都没有隐瞒。”
Wang 接着表示,这些解雇背后的理由“说不通”,并且她和她的同事们“并非首批在可疑情况下被 OpenAI 排挤出去的人”。
研究人员呼吁 OpenAI 遵守其公开承诺,即在组织内部嵌入第三方安全审计员,以保持对前沿模型的可监控性,并“继续支持安全研究人员与更广泛的安全生态系统之间开放、透明的对话文化”。
根据备忘录所述,OpenAI 同意他们的建议。
“除非员工们现在站出来反对这种手段,否则我担心我们不会是最后一批,”Wang 说。“给所有仍在 OpenAI 工作的人的信息很明确:如果你提出担忧或与外部安全团体密切合作,你可能就是下一个被解雇的人,而且不会被告知原因。如果最接近风险的人不敢发声,你就无法安全地构建 AGI。”