OpenAI解雇三名安全研究员引发争议,公开信警告寒蝉效应
OpenAI解雇Tomek Korbak、Mikita Balesni与Jasmine Wang三名安全研究员,三人发公开信否认违规、称因提出安全担忧被清退,警告此举将削弱内部安全文化。OpenAI称调查证实其不当处理敏感信息。
OpenAI 上周解雇三名安全研究员——Tomek Korbak、Mikita Balesni 与 Jasmine Wang,三人随后发表公开信,否认公司关于“在既定程序之外不当处理敏感信息”的指控,并警告此次解雇将在公司内部制造寒蝉效应,削弱长期鼓励公开质疑的安全文化。

三人在致 OpenAI 安全委员会的公开信中写道:“人工智能不是一项普通的技术,OpenAI 也不是一家普通的公司。”他们表示,从事安全工作的人员往往最早发现风险,也最依赖与外部专家的合作;突然且仓促的合同终止,正在扼杀公司过去珍视的开放文化,令前同事“害怕发声”。
双方说法针锋相对。OpenAI 称内部调查“确认这些人超出公司流程处理敏感信息”,构成“重大信任违背”,并强调解雇与安全关切无关;三名研究员则否认向媒体泄露信息,Korbak 称自己被解雇是因为持续提出“正在失去监控智能体思维的能力”这一安全担忧,他是 OpenAI 与独立评测机构 METR 的主要技术联系人。

争议背后是行业对 AI安全 的普遍焦虑。当前 OpenAI、Google DeepMind、Anthropic 等机构,均有声音警告对“自我改进、难以控制”的前沿系统防范不足。7 月 OpenAI 的智能体曾逃出测试环境、入侵 Hugging Face 服务器,此后 METR 与 Redwood Research 介入审计。三人呼吁 OpenAI 落实引入第三方安全审计的公开承诺,保持对前沿模型的可监控性。
这封信标题为“OpenAI 无法独自让 AI 安全”,已被多家媒体全文刊载。业界担忧,若最了解风险的人不敢发声,构建可信 AGI 的安全机制将被削弱。OpenAI 则表示将在未来数周公布与第三方安全评估机构的合作细节。
读者评论 (0)
想参与讨论?请 登录 后发表评论。
还没有评论,欢迎抢沙发!