专注于网络安全研究的美国初创公司 Hacktron AI 周五宣布,该公司利用 Anthropic 的 Claude 聊天机器人作为最初工具,攻破了多名 OpenAI 员工的 ChatGPT 账户。此次攻击是在 OpenAI 开展的漏洞识别奖励计划中实施的,公司向研究人员支付了 6,500 美元。
由三人组成的团队通过链式利用两个严重漏洞展开攻击。7 月 25 日,研究人员发现了 Discourse 中的一个漏洞。Discourse 是一家第三方供应商为 OpenAI 社区论坛提供的软件。在获得服务器访问权限后,他们发现了第二个漏洞,该漏洞使他们能够接管部分 ChatGPT 和 Codex 账户,其中包括 OpenAI 员工的账户。
其中一个被攻破的账户将 Codex 连接至 GitHub 上的 OpenAI 组织,使研究人员能够访问部分软件应用的缓存,并可能访问其他内部系统。Hacktron 表示,最初使用的 Claude 模型未能开发出可运行的漏洞利用程序,但在新版本模型发布后,情况发生了变化。
OpenAI 和 Discourse 均已获悉此事,Discourse 于 7 月 27 日发布了更新。OpenAI 确认已修复相关漏洞。该事件进一步凸显了人工智能系统快速发展过程中接连出现的安全问题和相关警告。