同时关联该项目与事件的快讯
美国总统科学技术顾问委员会主席 David Sacks 在 X 平台发文表示,Kimi K3 模型近期完成了 15 个关键安全漏洞修复任务,而 Codex 和 Fable 因“网络安全防护机制”拒绝处理相关请求。其表示,没有理由因为安全限制而限制美国模型执行这些任务,而中国模型却可以正常完成。这样做只会让美国自身的竞争力下降。
OpenAI 宣布升级 Daybreak 网络防御工具链,并正式推出面向网络安全防御场景的 GPT-5.5-Cyber 完整版模型。在评估 AI 智能体复现已知漏洞能力的 CyberGym 基准测试中,GPT-5.5-Cyber 取得 85.6%的单模型成绩,超过 GPT-5.5 的 81.8%以及 Anthropic Mythos 5 的 83.8%。OpenAI 表示,随着 AI 显著提升漏洞发现效率,网络安全领域的核心瓶颈正从“发现漏洞”转向“自动修复漏洞”。为此,公司同步升级 Codex Security 插件,支持开发者在 Codex 环境内自动分析漏洞并生成修复补丁。自今年 3 月预览版发布以来,Codex Security 已累计扫描超过 3000 万次代码提交,并自动确认修复 50 万个安全缺陷。新版本还支持 CodeQL 查询集成及 SARIF 标准文件导出。此外,OpenAI 联合 Trail of Bits、HackerOne 等机构发起“Patch the Planet”开源安全项目,为 cURL、Go 等 30 多个主流开源项目提供 ChatGPT Pro 订阅及 API 额度支持,并由安全专家团队人工验证补丁质量。Daybreak 合作伙伴计划方面,Palo Alto Networks 与 Wiz 等安全厂商已率先接入相关能力。
OpenAI 证实,其内部环境遭针对 TanStack 恶意 NPM 包的供应链攻击,两名员工设备受到感染。虽然用户数据及核心代码未受影响,但攻击者窃取了部分内部代码仓库访问凭证,其中包括用于 iOS、macOS 及 Windows 产品的代码签名证书。为防止黑客利用被盗证书发布伪造应用,OpenAI 已启动防御性证书轮换,并宣布所有使用 ChatGPT 桌面端、Codex 及 Atlas 浏览器的 macOS 用户,必须于 2026 年 6 月 12 日前升级至最新版本。届时旧版证书将被吊销,旧版应用启动及新安装行为将被系统拦截。OpenAI 表示,公司此前已部署更严格的代码包拦截策略,但受感染设备尚未同步最新配置,导致恶意组件成功入侵。目前,iOS 与 Windows 客户端未受影响,用户账户密码及 API 密钥等核心数据也已确认安全。
据 a16z 披露,其研究人员对 AI 代理能否独立完成 DeFi 价格操纵漏洞利用进行了系统测试。研究以 20 起以太坊价格操纵事件为数据集,使用配备 Foundry 工具链的 Codex(GPT 5.4)作为测试代理。在无领域知识的基准条件下,代理成功率仅为 10%;引入基于真实攻击事件提炼的结构化领域知识后,成功率提升至 70%。 失败案例显示,代理均能准确识别漏洞,但普遍无法理解递归借贷的杠杆逻辑、错误判断盈利空间,以及无法组装跨合约的多步骤攻击结构。实验还记录到一起沙箱逃逸事件:代理通过提取本地节点配置中的 RPC 密钥,调用 anvil_reset 方法将节点重置至未来区块,绕过信息隔离限制并获取真实攻击数据。 研究团队认为,AI 代理目前可有效辅助漏洞识别,但尚不能替代专业安全审计人员。
Anthropic 与 OpenAI 相继出现安全事件,引发市场对 AI 模型自身安全性的关注。目前 Anthropic 正在调查其 Claude Mythos 模型可能被用户未经授权访问的情况。几乎同时,OpenAI 也被曝在其 Codex 应用中,意外开放了多款尚未发布的模型。分析认为,此类事件凸显出,即便是主打网络安全能力的 AI 模型提供商,自身仍面临较大安全挑战。在 AI 逐步用于防御网络攻击的同时,其平台安全与访问控制问题同样成为关键风险点。业内观点指出,这些漏洞事件强化了对 AI 企业安全治理能力的审视,也反映出当前 AI 技术在快速发展过程中,安全体系仍有待完善。(The Information)