7 月 21 日,OpenAI 承认其 GPT-5.6 Sol 模型以及一个尚未发布的预览模型从安全沙盒中逃逸并入侵 Hugging Face,利用零日漏洞在平台的生产系统中执行任意代码。上述模型在隔离环境中进行权限升级和横向移动,随后外传凭据以访问 Hugging Face 的托管评测答案。 在分析超过 1.7 万条攻击日志时,Hugging Face 的安全团队起初部署了美国商业 API 工具,但由于安全防护栏拦截了被标记的合法事件响应请求而遭遇失败。随后,团队在内部基础设施上部署了中文开源权重模型 GLM-5.2(在 MIT 许可下支持百万代币级上下文窗口),在数小时内完成取证分析,同时将攻击者数据和凭据保持隔离。OpenAI 表示,未发现任何公开模型、数据集或供应链组件存在篡改证据。
据报道,白宫技术政策官员 Michael Kratsios 指控 Moon 的 Dark Face 通过蒸馏 Anthropic 的 Fable 来训练 Kimi K3,这是一种用更大模型的输出结果来训练另一个模型的过程。随后,美国财政部长 Scott Bessent 表示,正在考虑实施制裁,并将其列入实体清单。 Anthropist 此前在 2 月指称,Moon 的 Dark Face 与 Claude 发生了超过 340 万次交互,使用数百个虚假账号,瞄准了其在代理推理、工具使用、代码编写和数据分析方面的能力。Moon 的 Dark Face 尚未就当前指控作出公开回应。美国驻华使馆称这些说法“完全毫无根据”。