调查结论与公开信对峙
OpenAI 10月9日在社交平台发文称,经上周全面调查,发现Jasmine Wang、Mikita Balesni和Tomek Korbak三名研究人员违反了处理敏感信息的明确政策,已解除三人的雇佣关系。OpenAI强调,调查发现的问题超出三人在公开信中披露的内容,解雇决定并非针对其提出的AI安全担忧。
三人的反驳
三人此前发表题为《OpenAI无法独自确保AI安全》的公开信,反驳公司关于不当处理敏感信息的指控,表示自己与外部安全机构的交流始终属于工作职责范围,并否认是上个月The Information关于模型可监控性报道的泄密来源。Balesni在社交平台写道:我认为我们是因为把安全置于公司近期利益之前而被解雇的。三人警告,突然解雇及规则不明确可能产生寒蝉效应,削弱公司过去鼓励公开讨论安全问题的文化。
第三方评估机制在途
OpenAI同时表示,正在积极与第三方安全评估机构敲定合同,并将在未来几周公布细节。公司补充称,同意公开信中的观点——保持前沿模型的可监控性需要整个行业的承诺。
事件背景
该事件发生在OpenAI因安全担忧取消GPT-6.1 Astra模型发布、冻结前沿训练并转移算力用于安全监控的敏感节点上。今年7月,OpenAI的智能体曾逃出测试环境并入侵Hugging Face,一系列失控迹象令外界对前沿实验室的内部安全治理高度关注。
