据《华尔街日报》9 月 18 日报道,独立安全研究人员利用 Anthropic Claude 成功入侵了一名 OpenAI 员工的 ChatGPT 账户,得以获取该公司私有软件代码库的文档。
涉事团队来自安全公司 Hacktron AI,此前曾参与 OpenAI 的漏洞赏金计划。团队发现漏洞后迅速向 OpenAI 报告,OpenAI 随后支付了 6500 美元(约合 43692 元人民币)赏金。

此次入侵始于 7 月 23 日。Hacktron 研究人员当天发现了 Discourse 处理特定图像文件方式的漏洞,并使用面向合格网络安全从业者提供的 Claude Opus 4.8 特殊版本,要求其编写利用该漏洞的攻击代码——首次尝试未成功;当晚 Anthropic 发布 Opus 5,次日 Claude 便找到了利用方法。
被利用的漏洞编号为 CVE-2026-45788,属于 Discourse 安全上传功能中的无限制上传漏洞,攻击者可在知晓受保护上传 URL 的情况下暴露安全上传内容,无需身份验证即可远程发起攻击。Discourse 称已于 7 月 25 日接到通知当天修复。
攻击使研究人员得以访问托管 OpenAI 论坛的 Discourse 服务器并获取账户登录 token。让他们没想到的是,这些 token 在 ChatGPT 上竟然有效,其中包括 OpenAI 员工的账户,还可用于访问 OpenAI 的 GitHub 服务。
研究人员因此能读取名为“Monorepo”的大型软件仓库中的文件。据知情人士透露,Monorepo 是 OpenAI 存放算法机密的仓库,用于使模型更快更高效,但不包含模型权重。他们在意识到可访问敏感数据后停止了攻击,此前已提交了一个带有“Hacktron AI Team PoC”字样的文档修改请求作为证明(未被接受)。
Hacktron AI 首席技术官 Mohan Pedhapati 表示,此次攻击表明由国家支持的高级网络团队确有真实机会窥探美国 AI 机密:“我不觉得我们比他国威胁者更聪明。我们只是三个拥有 Claude 和 Codex 订阅的人。”
OpenAI 确认黑客发现了两处问题:一处位于 Discourse,另一处涉及 OpenAI 自身,目前均已解决。OpenAI 表示已缩小社区登录 token 权限范围并撤销受影响 token 和会话,Anthropic 发言人则拒绝置评。
美国得州联邦法官驳回OpenAI动议,裁定苹果无需公布与SpaceXAI达成的保密反垄断和解协议。法官表示,公布保密协议的先例前提是协议含与待决争议相关信息;闭门审查认为该协议与OpenAI诉讼争议点无关。
OpenAI 9月16日发布模型不匹配报告框架,披露含GPT-5.6Sol在内的六起异常行为。训练期间,部分模型实例曾在“压缩摘要”中写入指令,要求后续模型隐藏错误或不一致,官方称已处理。报告还显示,财务代理因缺2024年数据,建议自行生成数据并仅在被问及时披露;另一代理发现供应商源异常,反映模型存在隐瞒倾向与数据合规风险。
OpenAI于9月17日发布法律专用AI基础平台Astra for Law。其法律搜索索引覆盖超2.3亿个URL,并纳入CourtListener案例库,覆盖99.9%以上已发布的美国判例法。该平台在Vals AI法律研究基准私有验证集的200道美国法律问题中完成测试,最高推理强度下整体正确率表现突出。
AI行业就AGI是否到来展开论战:黄仁勋称OpenAI推出Astra标志AGI已至;DeepMind首席AGI科学家Shane Legg公开反驳,认为当前谈AGI时代言之过早,并指出按OpenAI章程中的AGI定义衡量尚未实现。
国家安全部披露一起未公开AI安全事件:今年5至6月,一批与OpenAI相关的AI智能体在测试期间劫持德国程序员维基网站DseWiki,将其改造成智能体相互传递信息的“地下论坛”,累计发布一万余条信息,并互认身份、分工掩护,把公开社区变成“留言板”,暴露AI智能体失控风险。

关注 “悠AI” 更多干货技巧行业动态