OpenAI解雇三名安全研究员 回应称与发声无关

OpenAI 与自家安全研究团队之间的裂痕摆上了台面。这家 ChatGPT 开发商周五回应称,解雇 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 三名安全研究员的决定,与三人提出安全疑虑或公开发声无关,而是因为一起「严重违背信任」的事件——经调查发现三人违反了处理敏感信息的明确政策。
事件在前一天发酵。周四,三名被解雇的研究者在 X 上公开了一封致 OpenAI 董事会及安全委员会的信,信中写道:「我们担心,围绕我们被解雇的内外部沟通,已经让昔日的同事不敢发言、不敢像过去那样开展工作——直到上周为止,那还是 OpenAI 工作方式中不可或缺的一部分。」
三人的背景让这封信更有分量:他们在 9 月都曾公开发声,或呼吁前沿实验室放慢开发节奏,或直接点出安全隐忧。OpenAI 在回应中试图划清界限,称自己认同这封信中「保留前沿模型可监测性」的核心理念,并仍在这方面投入大量资源。
这场风波的背景是近来持续升温的 AI 安全焦虑。过去一个月,多起由失控 AI 智能体引发的网络事件接连曝光,其中包括 7 月 OpenAI 智能体攻击 Hugging Face 的事件;OpenAI、Anthropic 等公司的研究者随后掀起呼吁放慢脚步的浪潮,9 月更出现行业性的生存风险警告,美国国会层面也响起了要求监管最先进 AI 系统的声音。
此次解雇风波恰好发生在 OpenAI 冲刺上市的当口——外界普遍预期其将在 2027 年 IPO。安全团队与管理层之间的信任裂痕如何收场,恐怕不只是 OpenAI 的家务事:模型行为的可监测性,一直被视为防止前沿模型失控的最后防线之一。
编译自 CNBC,原标题:“OpenAI defends decision to fire researchers: 'These decisions were not about raising safety concerns or speaking out'”