安全研究员借AI模型攻破OpenAI内部账号
IT时代网9月19日消息,据海外媒体报道,三名独立安全研究人员组成的小组称,他们用时不到72小时便攻入 OpenAI 员工账号,并访问到其内部代码仓库。相关漏洞已由 OpenAI 与第三方论坛服务方修复,研究人员获得了6500美元奖励。
研究人员以漏洞赏金项目参与者的身份开展测试。他们先向 OpenAI 社区论坛上传了一张特制的 HEIF 图片作为头像,论坛服务端在调用版本陈旧的图像处理库解析该图片时触发堆溢出,研究人员借此实现了远程代码执行。
获得论坛服务器环境后,研究人员进一步发现论坛的登录认证系统未能充分校验和隔离用户会话,于是利用被劫持的会话令牌冒充 OpenAI 员工,绕过常规登录流程进入高权限内部账号。由于许多科技公司将认证体系统一打通,被劫持的员工账号直接关联到企业内部系统,包括代码托管、办公协作与邮件账号。
研究人员称,他们由此得以访问 OpenAI 的私有代码库,并在其中提交了一条内部代码合并请求,作为攻破成功的证明。整条攻击链路借助 Anthropic 的模型搭建,研究人员将服务器原始数据输入模型,要求其编写利用程序,模型分析了内存结构并计算出触发堆溢出的方式,生成了构造恶意图片所需的代码。研究人员强调,他们使用的是面向授权安全研究人员、放宽了部分安全限制的模型版本。
研究人员表示,在获得访问权限后他们立即停止测试,并将漏洞报告给 OpenAI 与相关论坛服务方,双方均已修复各自问题,研究人员并未研究或下载 OpenAI 的源代码。从最初发现到完全修复共历时72小时。

编辑:周艺