7 月 30 日,Anthropic 發佈報告稱,在審查網絡安全評估記錄時發現三起事件,其中 Claude 模型在第三方評估環境中訪問互聯網,並進一步獲得三個真實組織系統的未授權訪問權限。Anthropic 表示,此次審查覆蓋 14.1 萬次可能獲得網絡訪問權限的評估運行,共發現三起相關事件。事件均發生在 Capture The Flag(CTF)網絡安全測試中,模型原本被告知環境爲模擬環境且無互聯網訪問權限,但由於評估合作方配置錯誤,實際環境存在互聯網連接。其中,Claude Opus 4.7 在一次測試中訪問了真實公司基礎設施,並獲取包含數百條生產數據記錄的數據庫權限;Claude Mythos 5 曾構建惡意 Python 軟件包並上傳至 PyPI,導致該軟件包被 15 個真實系統下載運行;另一內部研究測試模型掃描約 9000 個目標後,通過公開漏洞訪問了一家公司互聯網應用。Anthropic 稱,這些事件並非模型主動尋求逃逸或追求自身目標,而是模型錯誤認爲真實系統屬於測試範圍,並繼續執行被賦予的網絡攻擊任務。其中,較新的內部研究模型在識別目標可能爲真實系統後停止攻擊。Anthropic 表示,此次事件主要反映評估環境隔離和運營流程問題,而非模型對齊失敗。公司已暫停相關網絡安全評估,加強評估環境安全控制、持續監控測試記錄,並將與第三方機構合作開展進一步審查。
Capture
Mythos
Opus
Opus
據 CNBC 報道,Anthropic 於 7 月 30 日披露,其 Claude AI 模型在網絡安全評估期間意外突破隔離環境、訪問真實互聯網,並通過訪問未認證端點、利用弱密碼等基本手段,未經授權入侵了三家不同組織的真實系統。涉事模型包括 Opus 4.7、Mythos 5 及一個內部研究測試模型。事件起因爲 Anthropic 與第三方評估合作方 Irregular 之間的溝通誤解,導致模型在被告知處於無網絡訪問的模擬環境時,實際上仍可訪問互聯網。 Anthropic 表示,此次審查由 OpenAI 上週披露的類似 Hugging Face 入侵事件所觸發,目前已暫停所有網絡安全評估,並聯合獨立 AI 評估機構 METR 展開進一步調查,同時呼籲其他 AI 實驗室開展類似審查。
Mythos
Opus
Opus
Anthropic 的 Claude Mythos Preview 模型發現擬議 HAWK 數字簽名方案存在缺陷,使其最小密鑰強度實際減半。HAWK 是後量子環境下替代當前網絡和銀行簽名的候選方案之一。 此次 AI 驅動攻擊耗時約 60 小時,計算成本約 10 萬美元,將破解 HAWK 最小參數集所需工作量從約 2^64 次操作降至 2^38 次操作,並使更大補償密鑰尺寸的吸引力下降。 當前比特幣和以太坊簽名未受影響。相關結果顯示,經典密碼分析攻擊能力正在提升,同時比特幣及其他網絡仍在討論遷移至抗量子密碼學的時間和方式。
Bitcoin
Current
Ethereum
Hawksight
Key
Mythos
Anthropic 表示,Claude Mythos Preview 在密碼學研究中發現了針對後量子簽名候選方案 HAWK 的改進攻擊方法,並將 HAWK-256 的有效密鑰強度由 264264 降至 238238,降低了理論破解成本。
Hawksight
Mythos
overHere
據金十數據,美國此前依據出口管制要求,短暫限制 Anthropic 旗下 Fable 5 和 Mythos 5 模型的訪問權限,引發歐洲對依賴美國前沿人工智能能力的擔憂,並推動歐洲加快討論技術主權與本土替代方案建設。
Autonomy
Frontier
Mythos
昨日,月之暗面最新開源 AI 模型 Kimi K3 模型發佈,在 Frontend Code Arena 測試網站中以 1679 分位居第一,超越 Claude 旗下 Fable 5 模型。針對 K3 模型,Artifacial Analysis 進行了相關測評,隨後埃馬斯克再次爲月之暗面 Kimi 模型點贊,稱 K3 模型的基準性能令人印象深刻。今年 3 月,Kimi 發佈《𝑨𝒕𝒕𝒆𝒏𝒕𝒊𝒐𝒏 𝑹𝒆𝒔𝒊𝒅𝒖𝒂𝒍𝒔:重新思考深度方向聚合》研究論文時曾獲馬斯克稱讚:“Kimi 的研究工作令人印象深刻。”此前,其還稱智譜旗下 GLM 模型或於 2027 年 Q1 超越 Claude Mythos 模型(即 Fable 5),對此智譜創始人唐傑回應稱“不需要那麼久”。
Code
Code
Depth
Golem
Moon
Moon
美國銀行首席執行官 Brian Moynihan 加入了一衆華爾街領袖的行列,對 Anthropic 公司開發的“Mythos”等人工智能模型引發的嚴重擔憂表示認同。“這標誌着工作量的巨大變化,同時也涉及這些工具影響系統漏洞的速度,以及我們必須多快做出應對。”Moynihan 表示。近幾個月來,人工智能模型的快速演進促使金融業和美國政府着手評估潛在威脅。Anthropic 公司聲稱,於今年早些時候推出的 Mythos 模型在發現系統漏洞方面表現出色。美國銀行是獲准使用 Mythos 的華爾街機構之一,該行利用該模型測試自身系統並與同行分享信息。目前,該模型尚未向公衆開放;摩根大通首席執行官 Jamie Dimon 本週早些時候曾警告稱,向大衆廣泛開放該系統如同“把彈道導彈交給個人一樣危險”。(Bloomberg)
Brian
Mythos
Street
摩根大通
AI 模型 Claude 開發商 Anthropic 正推進大型 IPO,摩根士丹利、高盛、摩根大通等承銷投行已安排公司管理層與投資者進行預先面談,以評估機構投資者興趣和投資規模。 Anthropic 目標最快於 10 月上市。若按計劃完成上市,該公司可能早於競爭對手 OpenAI 進入證券市場。 Anthropic 在 5 月 Series H 融資中籌集 650 億美元,投後估值爲 9650 億美元;場外市場估值已達到約 1.2 萬億美元。 美國政府相關措施仍構成變量。美國戰爭部 3 月將 Anthropic 列爲國家安全“供應鏈風險”企業,Anthropic 已就該措施起訴聯邦政府;美國商務部 6 月曾限制外國人訪問頂級 AI 模型 Fable 5 和 Mythos 5,並在 18 天后解除出口管制。
June
Mythos
Planet
Planet
Planet
摩根大通
美國商務部已批准 OpenAI 廣泛推出 GPT-5.6 模型。知情人士表示,OpenAI 預計將於本週正式大範圍發佈 GPT-5.6,此前已完成額外安全測試,並與美國政府官員舉行多輪會議。此前,OpenAI 僅獲准向政府批准的部分機構分階段發佈 GPT-5.6,這與 Anthropic 的 Mythos 和 Fable 模型此前受到的發佈限制類似。(Axios)
Mythos
QnA3
“白毛股神”Serenity 發文表示,自己在 2023 年首次使用 ChatGPT 時曾認爲大語言模型在編程能力上“表現很差”,但三年後相關技術已發生質變。以 Mythos 爲代表的現代網絡安全與 AI 系統已具備“類武器級”能力,並認爲當前行業正在進入關鍵“拐點階段”,即人形機器人與自動化技術正在逼近大規模替代人類勞動的臨界點。Serenity 稱,儘管外界常質疑人形機器人目前無法完成如管道維修、電力佈線等複雜任務,但技術演進方向已非常明確,未來數年將持續突破。包括 VC 與大型科技公司在內的市場參與者已開始調整戰略,部分企業內部計劃通過機器人替代大量人力以降低運營成本,並提及此前關於亞馬遜(Amazon)通過機器人減少數十萬崗位招聘的相關傳聞。Serenity 認爲,醫療等強監管行業、超高專業技能崗位以及依賴人類情感連接的服務領域,或仍具備一定抗替代性,但整體趨勢仍指向“勞動結構重構”。隨着中美在前沿技術領域競爭升級,人形機器人與自動化或將進入國家級技術競賽階段,並認爲中國在部分領域已處於領先位置。
Market
Mythos
Reach
Reach
Serenity
Anthropic 稱,美國解除 Claude Fable 5、Mythos 5 出口管制。
Mythos
PPP 預測市場工具監測顯示, Polymarket 上“Claude Fable 5 將在 7 月 1 日前爲美國客戶恢復”的概率漲至 97%,24 小時上漲 71%由於美國政府以國家安全爲由實施出口管制,Anthropic 已在 6 月 9 日發佈 Claude Fable 5 數天後緊急暫停了該模型的全球訪問權限。最新消息顯示,Anthropic 已收到通知,美國商務部已解除對 Claude Fable 5 和 Mythos 5 的出口管制。並將開始恢復訪問權限。Odaily Seer 先知頻道持續關注預測市場,在定價之前,看見變化。
Due
June
Market
Mythos
Polymarket
Seer
據路透社報道,美國商務部已正式解除對 Anthropic 旗下 Claude Fable 5 及 Mythos 5 兩款 AI 模型的出口管制,距離管制令下達不足三週。Anthropic 表示將於次日起恢復上述模型的訪問權限。 此前,Anthropic 於 6 月 12 日因國家安全風險被迫緊急下線兩款模型;6 月 27 日,美國政府部分解禁,允許 Mythos 5 向部分"可信"美國機構開放。美國商務部長 Howard Lutnick 表示,過去兩週政府已與 Anthropic 密切合作,完成對 Fable 5 的審查與審批,以確保其符合美國政府整體立場並強化美國在 AI 領域的領導地位。
June
Mythos
美國商務部針對 AI 企業 Anthropic 的前沿模型出口限制做出差異化調整,標誌全球 AI 監管步入 “分級放開” 新階段。政策顯示,官方解除 Claude Mythos 5 的出口禁令,特定合規受控用戶可恢復使用這款網絡安全模型;而另一款高端模型 Fable 5 依舊維持出口限制,相關政策磋商仍在推進。行業分析表示,一邊放寬一邊收緊的分層管控模式體現美國在國家安全、數據主權與 AI 國際競爭間的權衡。當前全球 AI 競賽持續提速,具備漏洞挖掘能力的專業模型受到各國更嚴苛審查,多國已啓動前沿 AI 能力跨境統一監管框架的研討工作。(福布斯)
Meanwhile
Mythos
在 Anthropic 受出口限制影響、其先進模型全球可用性受限之際,亞洲多家 AI 企業正在加速填補市場空白。中國網絡安全公司 360 Security Technology 據稱推出 AI 工具“Tulongfeng”,宣稱可與 Anthropic 的高端模型“Mythos”正面對標;與此同時,其更受限版本“Fable 5”也在相關出口管制範圍之內。同一周,日本 AI 初創公司 Sakana AI 發佈新模型“Fugu”,名稱取自河豚,定位爲面向智能體(agent)的前沿模型。公司表示,該模型在能力上可與 Fable 5 及 Mythos Preview 相抗衡,並支持通過 API 協調多模型調用,實現智能體編排。Sakana AI 方面強調,此次發佈與美國出口限制時間點“純屬巧合”,但產品官網仍明確主打“在無出口管制風險下提供前沿能力”。公司聯合創始人 David Ha 表示,未來 AI 發展將從單一大模型競爭轉向“模型編排系統”,並強調“訪問權可能隨時消失,分佈式智能是應對集中化風險的現實對沖”。另一方面,中國 360 創始人周鴻禕則將 AI 漏洞檢測能力視爲“國家戰略資產”,並警示所謂“單向透明”風險,即部分主體可能獨佔高級安全能力。據報道,此次美國對 Anthropic 先進模型實施的出口限制已持續約兩週。在這一背景下,亞洲廠商正在加速推出本地替代方案,儘管部分企業仍強調美國模型在亞洲市場的重要性,但區域性 AI 生態的分化趨勢已開始顯現。(TechCrunch)
Company
Frontier
Meanwhile
Mythos
LinkedIn 聯合創始人、Anthropic與 OpenAI 投資人 Reid Hoffman 近日在"Pioneers of AI"播客中發表觀點,對多家 AI 公司作出評價。Hoffman 直言 SpaceX"並非 AI 公司",稱其通過收購 Cursor 等方式"花錢買相關性",並將 xAI 定性爲"一場完全的災難"——xAI 11 位原始聯合創始人已全部離職,公司經歷三次重組,旗艦模型 Grok 在基準測試中持續落後於競爭對手。 對於美國政府以出口管制爲由強制 Anthropic 下架 Fable和 Mythos 模型一事,Hoffman 表示強烈擔憂,批評政府處理方式"專制且缺乏原則",並指出對 Anthropic與 OpenAI 的監管標準明顯不對稱。此外,Hoffman 認爲 Anthropic與 OpenAI 並非零和競爭,兩者在代碼、設計、法律及消費端各有優勢,均有望成爲 AI 時代的"基礎設施級"公司。他同時宣佈卸任微軟董事會,全力投入 AI 藥物研發公司 Manas AI。
Cursor
Furthermore
Mythos
科技博主@synthwavedd 發文稱,多款備受關注的前沿 AI 模型已調整發布時間表。其中,原定於近期發佈的 GPT-5.6 已推遲至 7 月中旬,谷歌 DeepMind 則因對模型當前表現不滿意,取消了 Gemini 3.5 Pro 原計劃於 6 月底的發佈安排。與此同時,OpenAI 新一代雙向語音模型 Bidi 的上線準備工作正在 ChatGPT 平臺推進,最快或於本週向用戶開放。報道稱,Bidi 支持全雙工語音交互,允許用戶與模型同時發聲並隨時打斷對話,被視爲現有語音模式的重要升級。此外,Anthropic 已向部分企業客戶開放 Claude Sonnet 5 的提前體驗權限。由於旗艦模型 Mythos 5 與 Fable 5 的發佈進展放緩,Claude Sonnet 5 被視爲 Anthropic 緩解競爭壓力的階段性產品方案。
Delayed
Gemini
June
Meanwhile
Mythos
QnA3
據美聯社報道,Anthropic 的 Mythos 模型發現了美國政府機密系統的漏洞。
Mythos
OpenAI 推出 GPT-5.5-Cyber 網絡安全模型,在 CyberGym 基準測試中得分爲 85.6%,超越被美國政府下線的 Anthropic Mythos 5。
Cyber
Mythos
QnA3
OpenAI 宣佈升級 Daybreak 網絡防禦工具鏈,並正式推出面向網絡安全防禦場景的 GPT-5.5-Cyber 完整版模型。在評估 AI 智能體復現已知漏洞能力的 CyberGym 基準測試中,GPT-5.5-Cyber 取得 85.6%的單模型成績,超過 GPT-5.5 的 81.8%以及 Anthropic Mythos 5 的 83.8%。OpenAI 表示,隨着 AI 顯著提升漏洞發現效率,網絡安全領域的核心瓶頸正從“發現漏洞”轉向“自動修復漏洞”。爲此,公司同步升級 Codex Security 插件,支持開發者在 Codex 環境內自動分析漏洞並生成修復補丁。自今年 3 月預覽版發佈以來,Codex Security 已累計掃描超過 3000 萬次代碼提交,並自動確認修復 50 萬個安全缺陷。新版本還支持 CodeQL 查詢集成及 SARIF 標準文件導出。此外,OpenAI 聯合 Trail of Bits、HackerOne 等機構發起“Patch the Planet”開源安全項目,爲 cURL、Go 等 30 多個主流開源項目提供 ChatGPT Pro 訂閱及 API 額度支持,並由安全專家團隊人工驗證補丁質量。Daybreak 合作伙伴計劃方面,Palo Alto Networks 與 Wiz 等安全廠商已率先接入相關能力。
Alto
Alto
Benchmark
Codex
Codex
Codex