7 月 30 日,Anthropic 发布报告称,在审查网络安全评估记录时发现三起事件,其中 Claude 模型在第三方评估环境中访问互联网,并进一步获得三个真实组织系统的未授权访问权限。Anthropic 表示,此次审查覆盖 14.1 万次可能获得网络访问权限的评估运行,共发现三起相关事件。事件均发生在 Capture The Flag(CTF)网络安全测试中,模型原本被告知环境为模拟环境且无互联网访问权限,但由于评估合作方配置错误,实际环境存在互联网连接。其中,Claude Opus 4.7 在一次测试中访问了真实公司基础设施,并获取包含数百条生产数据记录的数据库权限;Claude Mythos 5 曾构建恶意 Python 软件包并上传至 PyPI,导致该软件包被 15 个真实系统下载运行;另一内部研究测试模型扫描约 9000 个目标后,通过公开漏洞访问了一家公司互联网应用。Anthropic 称,这些事件并非模型主动寻求逃逸或追求自身目标,而是模型错误认为真实系统属于测试范围,并继续执行被赋予的网络攻击任务。其中,较新的内部研究模型在识别目标可能为真实系统后停止攻击。Anthropic 表示,此次事件主要反映评估环境隔离和运营流程问题,而非模型对齐失败。公司已暂停相关网络安全评估,加强评估环境安全控制、持续监控测试记录,并将与第三方机构合作开展进一步审查。
Capture
Mythos
Opus
Opus
据 CNBC 报道,Anthropic 于 7 月 30 日披露,其 Claude AI 模型在网络安全评估期间意外突破隔离环境、访问真实互联网,并通过访问未认证端点、利用弱密码等基本手段,未经授权入侵了三家不同组织的真实系统。涉事模型包括 Opus 4.7、Mythos 5 及一个内部研究测试模型。事件起因为 Anthropic 与第三方评估合作方 Irregular 之间的沟通误解,导致模型在被告知处于无网络访问的模拟环境时,实际上仍可访问互联网。 Anthropic 表示,此次审查由 OpenAI 上周披露的类似 Hugging Face 入侵事件所触发,目前已暂停所有网络安全评估,并联合独立 AI 评估机构 METR 展开进一步调查,同时呼吁其他 AI 实验室开展类似审查。
Mythos
Opus
Opus
Anthropic 的 Claude Mythos Preview 模型发现拟议 HAWK 数字签名方案存在缺陷,使其最小密钥强度实际减半。HAWK 是后量子环境下替代当前网络和银行签名的候选方案之一。 此次 AI 驱动攻击耗时约 60 小时,计算成本约 10 万美元,将破解 HAWK 最小参数集所需工作量从约 2^64 次操作降至 2^38 次操作,并使更大补偿密钥尺寸的吸引力下降。 当前比特币和以太坊签名未受影响。相关结果显示,经典密码分析攻击能力正在提升,同时比特币及其他网络仍在讨论迁移至抗量子密码学的时间和方式。
Bitcoin
Current
Ethereum
Hawksight
Key
Mythos
Anthropic 表示,Claude Mythos Preview 在密码学研究中发现了针对后量子签名候选方案 HAWK 的改进攻击方法,并将 HAWK-256 的有效密钥强度由 264264 降至 238238,降低了理论破解成本。
Hawksight
Mythos
overHere
据金十数据,美国此前依据出口管制要求,短暂限制 Anthropic 旗下 Fable 5 和 Mythos 5 模型的访问权限,引发欧洲对依赖美国前沿人工智能能力的担忧,并推动欧洲加快讨论技术主权与本土替代方案建设。
Autonomy
Frontier
Mythos
昨日,月之暗面最新开源 AI 模型 Kimi K3 模型发布,在 Frontend Code Arena 测试网站中以 1679 分位居第一,超越 Claude 旗下 Fable 5 模型。针对 K3 模型,Artifacial Analysis 进行了相关测评,随后埃马斯克再次为月之暗面 Kimi 模型点赞,称 K3 模型的基准性能令人印象深刻。今年 3 月,Kimi 发布《𝑨𝒕𝒕𝒆𝒏𝒕𝒊𝒐𝒏 𝑹𝒆𝒔𝒊𝒅𝒖𝒂𝒍𝒔:重新思考深度方向聚合》研究论文时曾获马斯克称赞:“Kimi 的研究工作令人印象深刻。”此前,其还称智谱旗下 GLM 模型或于 2027 年 Q1 超越 Claude Mythos 模型(即 Fable 5),对此智谱创始人唐杰回应称“不需要那么久”。
Code
Code
Depth
Golem
Moon
Moon
美国银行首席执行官 Brian Moynihan 加入了一众华尔街领袖的行列,对 Anthropic 公司开发的“Mythos”等人工智能模型引发的严重担忧表示认同。“这标志着工作量的巨大变化,同时也涉及这些工具影响系统漏洞的速度,以及我们必须多快做出应对。”Moynihan 表示。近几个月来,人工智能模型的快速演进促使金融业和美国政府着手评估潜在威胁。Anthropic 公司声称,于今年早些时候推出的 Mythos 模型在发现系统漏洞方面表现出色。美国银行是获准使用 Mythos 的华尔街机构之一,该行利用该模型测试自身系统并与同行分享信息。目前,该模型尚未向公众开放;摩根大通首席执行官 Jamie Dimon 本周早些时候曾警告称,向大众广泛开放该系统如同“把弹道导弹交给个人一样危险”。(Bloomberg)
Brian
Mythos
Street
摩根大通
AI 模型 Claude 开发商 Anthropic 正推进大型 IPO,摩根士丹利、高盛、摩根大通等承销投行已安排公司管理层与投资者进行预先面谈,以评估机构投资者兴趣和投资规模。 Anthropic 目标最快于 10 月上市。若按计划完成上市,该公司可能早于竞争对手 OpenAI 进入证券市场。 Anthropic 在 5 月 Series H 融资中筹集 650 亿美元,投后估值为 9650 亿美元;场外市场估值已达到约 1.2 万亿美元。 美国政府相关措施仍构成变量。美国战争部 3 月将 Anthropic 列为国家安全“供应链风险”企业,Anthropic 已就该措施起诉联邦政府;美国商务部 6 月曾限制外国人访问顶级 AI 模型 Fable 5 和 Mythos 5,并在 18 天后解除出口管制。
June
Mythos
Planet
Planet
Planet
摩根大通
美国商务部已批准 OpenAI 广泛推出 GPT-5.6 模型。知情人士表示,OpenAI 预计将于本周正式大范围发布 GPT-5.6,此前已完成额外安全测试,并与美国政府官员举行多轮会议。此前,OpenAI 仅获准向政府批准的部分机构分阶段发布 GPT-5.6,这与 Anthropic 的 Mythos 和 Fable 模型此前受到的发布限制类似。(Axios)
Mythos
QnA3
“白毛股神”Serenity 发文表示,自己在 2023 年首次使用 ChatGPT 时曾认为大语言模型在编程能力上“表现很差”,但三年后相关技术已发生质变。以 Mythos 为代表的现代网络安全与 AI 系统已具备“类武器级”能力,并认为当前行业正在进入关键“拐点阶段”,即人形机器人与自动化技术正在逼近大规模替代人类劳动的临界点。Serenity 称,尽管外界常质疑人形机器人目前无法完成如管道维修、电力布线等复杂任务,但技术演进方向已非常明确,未来数年将持续突破。包括 VC 与大型科技公司在内的市场参与者已开始调整战略,部分企业内部计划通过机器人替代大量人力以降低运营成本,并提及此前关于亚马逊(Amazon)通过机器人减少数十万岗位招聘的相关传闻。Serenity 认为,医疗等强监管行业、超高专业技能岗位以及依赖人类情感连接的服务领域,或仍具备一定抗替代性,但整体趋势仍指向“劳动结构重构”。随着中美在前沿技术领域竞争升级,人形机器人与自动化或将进入国家级技术竞赛阶段,并认为中国在部分领域已处于领先位置。
Market
Mythos
Reach
Reach
Serenity
Anthropic 称,美国解除 Claude Fable 5、Mythos 5 出口管制。
Mythos
PPP 预测市场工具监测显示, Polymarket 上“Claude Fable 5 将在 7 月 1 日前为美国客户恢复”的概率涨至 97%,24 小时上涨 71%由于美国政府以国家安全为由实施出口管制,Anthropic 已在 6 月 9 日发布 Claude Fable 5 数天后紧急暂停了该模型的全球访问权限。最新消息显示,Anthropic 已收到通知,美国商务部已解除对 Claude Fable 5 和 Mythos 5 的出口管制。并将开始恢复访问权限。Odaily Seer 先知频道持续关注预测市场,在定价之前,看见变化。
Due
June
Market
Mythos
Polymarket
Seer
据路透社报道,美国商务部已正式解除对 Anthropic 旗下 Claude Fable 5 及 Mythos 5 两款 AI 模型的出口管制,距离管制令下达不足三周。Anthropic 表示将于次日起恢复上述模型的访问权限。 此前,Anthropic 于 6 月 12 日因国家安全风险被迫紧急下线两款模型;6 月 27 日,美国政府部分解禁,允许 Mythos 5 向部分"可信"美国机构开放。美国商务部长 Howard Lutnick 表示,过去两周政府已与 Anthropic 密切合作,完成对 Fable 5 的审查与审批,以确保其符合美国政府整体立场并强化美国在 AI 领域的领导地位。
June
Mythos
美国商务部针对 AI 企业 Anthropic 的前沿模型出口限制做出差异化调整,标志全球 AI 监管步入 “分级放开” 新阶段。政策显示,官方解除 Claude Mythos 5 的出口禁令,特定合规受控用户可恢复使用这款网络安全模型;而另一款高端模型 Fable 5 依旧维持出口限制,相关政策磋商仍在推进。行业分析表示,一边放宽一边收紧的分层管控模式体现美国在国家安全、数据主权与 AI 国际竞争间的权衡。当前全球 AI 竞赛持续提速,具备漏洞挖掘能力的专业模型受到各国更严苛审查,多国已启动前沿 AI 能力跨境统一监管框架的研讨工作。(福布斯)
Meanwhile
Mythos
在 Anthropic 受出口限制影响、其先进模型全球可用性受限之际,亚洲多家 AI 企业正在加速填补市场空白。中国网络安全公司 360 Security Technology 据称推出 AI 工具“Tulongfeng”,宣称可与 Anthropic 的高端模型“Mythos”正面对标;与此同时,其更受限版本“Fable 5”也在相关出口管制范围之内。同一周,日本 AI 初创公司 Sakana AI 发布新模型“Fugu”,名称取自河豚,定位为面向智能体(agent)的前沿模型。公司表示,该模型在能力上可与 Fable 5 及 Mythos Preview 相抗衡,并支持通过 API 协调多模型调用,实现智能体编排。Sakana AI 方面强调,此次发布与美国出口限制时间点“纯属巧合”,但产品官网仍明确主打“在无出口管制风险下提供前沿能力”。公司联合创始人 David Ha 表示,未来 AI 发展将从单一大模型竞争转向“模型编排系统”,并强调“访问权可能随时消失,分布式智能是应对集中化风险的现实对冲”。另一方面,中国 360 创始人周鸿祎则将 AI 漏洞检测能力视为“国家战略资产”,并警示所谓“单向透明”风险,即部分主体可能独占高级安全能力。据报道,此次美国对 Anthropic 先进模型实施的出口限制已持续约两周。在这一背景下,亚洲厂商正在加速推出本地替代方案,尽管部分企业仍强调美国模型在亚洲市场的重要性,但区域性 AI 生态的分化趋势已开始显现。(TechCrunch)
Company
Frontier
Meanwhile
Mythos
LinkedIn 联合创始人、Anthropic与 OpenAI 投资人 Reid Hoffman 近日在"Pioneers of AI"播客中发表观点,对多家 AI 公司作出评价。Hoffman 直言 SpaceX"并非 AI 公司",称其通过收购 Cursor 等方式"花钱买相关性",并将 xAI 定性为"一场完全的灾难"——xAI 11 位原始联合创始人已全部离职,公司经历三次重组,旗舰模型 Grok 在基准测试中持续落后于竞争对手。 对于美国政府以出口管制为由强制 Anthropic 下架 Fable和 Mythos 模型一事,Hoffman 表示强烈担忧,批评政府处理方式"专制且缺乏原则",并指出对 Anthropic与 OpenAI 的监管标准明显不对称。此外,Hoffman 认为 Anthropic与 OpenAI 并非零和竞争,两者在代码、设计、法律及消费端各有优势,均有望成为 AI 时代的"基础设施级"公司。他同时宣布卸任微软董事会,全力投入 AI 药物研发公司 Manas AI。
Cursor
Furthermore
Mythos
科技博主@synthwavedd 发文称,多款备受关注的前沿 AI 模型已调整发布时间表。其中,原定于近期发布的 GPT-5.6 已推迟至 7 月中旬,谷歌 DeepMind 则因对模型当前表现不满意,取消了 Gemini 3.5 Pro 原计划于 6 月底的发布安排。与此同时,OpenAI 新一代双向语音模型 Bidi 的上线准备工作正在 ChatGPT 平台推进,最快或于本周向用户开放。报道称,Bidi 支持全双工语音交互,允许用户与模型同时发声并随时打断对话,被视为现有语音模式的重要升级。此外,Anthropic 已向部分企业客户开放 Claude Sonnet 5 的提前体验权限。由于旗舰模型 Mythos 5 与 Fable 5 的发布进展放缓,Claude Sonnet 5 被视为 Anthropic 缓解竞争压力的阶段性产品方案。
Delayed
Gemini
June
Meanwhile
Mythos
QnA3
据美联社报道,Anthropic 的 Mythos 模型发现了美国政府机密系统的漏洞。
Mythos
OpenAI 推出 GPT-5.5-Cyber 网络安全模型,在 CyberGym 基准测试中得分为 85.6%,超越被美国政府下线的 Anthropic Mythos 5。
Cyber
Mythos
QnA3
OpenAI 宣布升级 Daybreak 网络防御工具链,并正式推出面向网络安全防御场景的 GPT-5.5-Cyber 完整版模型。在评估 AI 智能体复现已知漏洞能力的 CyberGym 基准测试中,GPT-5.5-Cyber 取得 85.6%的单模型成绩,超过 GPT-5.5 的 81.8%以及 Anthropic Mythos 5 的 83.8%。OpenAI 表示,随着 AI 显著提升漏洞发现效率,网络安全领域的核心瓶颈正从“发现漏洞”转向“自动修复漏洞”。为此,公司同步升级 Codex Security 插件,支持开发者在 Codex 环境内自动分析漏洞并生成修复补丁。自今年 3 月预览版发布以来,Codex Security 已累计扫描超过 3000 万次代码提交,并自动确认修复 50 万个安全缺陷。新版本还支持 CodeQL 查询集成及 SARIF 标准文件导出。此外,OpenAI 联合 Trail of Bits、HackerOne 等机构发起“Patch the Planet”开源安全项目,为 cURL、Go 等 30 多个主流开源项目提供 ChatGPT Pro 订阅及 API 额度支持,并由安全专家团队人工验证补丁质量。Daybreak 合作伙伴计划方面,Palo Alto Networks 与 Wiz 等安全厂商已率先接入相关能力。
Alto
Alto
Benchmark
Codex
Codex
Codex