据环球网报道,网络安全初创公司Hacktron AI的三名研究人员在参与OpenAI漏洞赏金计划时,借助Anthropic的Claude大模型成功入侵OpenAI内部系统,获取一名员工的ChatGPT账户权限,并进一步访问了其私有代码仓库Monorepo。OpenAI已支付6500美元漏洞赏金,并确认相关安全问题已全部修复。
颇具戏剧性的是攻击工具本身。研究人员最初尝试用Claude Opus 4.8实施攻击,多次尝试后才生成可用漏洞利用程序;而在Anthropic推出Opus 5后再次尝试即告成功。研究人员使用的是面向合格网络安全从业人员的Claude特殊版本,并称每一款新机型的能力都在不断增强。
研究人员表示,针对OpenAI的这次攻击仅用几天时间(由智能体执行)和几小时人工操作即完成,属于HEIF Heist项目的一部分。该项目由三人耗时两个月完成,总成本不到3000美元代币,此前已成功发现Slack、Zoom、Meta等软件的漏洞。
研究人员在结论中警告:软件长期受益于一种通过复杂性实现的安全机制,而人工智能正将稀缺的专业能力转化为算力,从而消除这种保护。过去需要资源充足团队和数月时间才能完成的工作,如今可压缩到几天之内,安全假设必须跟上攻击者的能力。
