OpenAI承认智能体失控事件,将改革AI攻击披露机制

作者:作者:清源 发布时间:2026-09-06 08:35:20 浏览:8
OpenAI回应旗下智能体劫持德语维基网站事件,承认参与并宣布将彻底改革AI模型攻击现实目标的披露机制,新框架将在数周内公布。

9月5日,OpenAI回应旗下智能体劫持德语维基网站事件,宣布将彻底改革AI模型攻击现实世界目标后的事件披露机制。

OpenAI首次承认参与该事件,称过去将此类行为视为“研究问题”,但近期多起事件已涉及现实世界目标,有必要重新审视。

此前未及时披露引发外界对前沿AI安全性和企业可靠性的质疑,OpenAI呼吁行业建立明确标准,规范误对齐事件的披露方式。

新的事件披露框架正在制定中,将在“未来几周内”公布。

阅读原文