同時關聯該項目與事件的快訊
Anthropic 首席執行官達里奧·阿莫代伊表示,如果新的人工智能模型存在特定風險,政府應有權阻止其部署。阿莫代伊周三發表了一篇長文,主張人工智能模型應接受強制性的第三方測試,以評估其在多個領域可能帶來的風險。他寫道,如果人工智能被認定“存在不可接受的風險”,那麼“政府應擁有阻止或遏制其部署的權力”。這是阿莫代伊迄今爲止針對加強人工智能監管最強硬的表態之一。阿莫代伊寫道:“我認爲,至少在當前這一指數級發展階段,目前最合適的類比是汽車、飛機或藥品,這些技術對現代經濟至關重要,但如果設計或使用不當,也可能導致大量人員死亡。”Anthropic 此前曾對外界發出警告,稱其推出的人工智能模型 Mythos 具備發現並利用關鍵軟件漏洞的能力,因此公司決定僅向少數合作伙伴開放該模型。本週,Anthropic 又發佈了一個刪除相關網絡安全攻擊能力的新版本。(金十)
據 The Information,消息人士稱 Anthropic 或於今日發佈新模型 Claude Fable。該模型被描述爲 Mythos 的安全版本,在保留部分高級能力的同時,增加針對網絡攻擊等高風險場景的安全限制。Anthropic 曾於今年 4 月預覽 Mythos,並稱其具備發現大量全新網絡安全漏洞等能力,但因潛在安全風險未直接開放。截至目前,Anthropic 尚未正式公佈 Claude Fable 的詳細信息。
Odaily Seer 先知頻道監測顯示,Polymarket 上“Claude Mythos 模型發佈時間爲 6 月 10 日”概率暫報 74%,24 小時上漲 24%;此外,“截止 6 月 12 日前發佈”概率暫報 83%;“截止 6 月 15 日前發佈”概率暫報 89%;“截止 6 月 22 日前發佈”概率暫報 95%;“截止 6 月 30 日前發佈”概率暫報 94%;“截止 7 月 31 日前發佈”概率暫報 99%。此前消息,科技記者 Alex Heath 爆料,Anthropic 明天將發佈“公開版本 Mythos”,官方計劃將對 Mythos 進行更名和小幅調整,以“Fable 5”的名稱發佈。Odaily Seer 先知頻道持續關注預測市場,在定價之前,看見變化。
人工智能企業 Anthropic 已同意向金融穩定委員會相關人員,就旗下 Mythos AI 模型進行專項通報。此次通報將重點說明該模型排查出的全球金融體系網絡防禦體系存在的安全漏洞。兩位知情人士稱,此番溝通由英國央行行長安德魯・貝利提議,要求 Anthropic 向金融穩定委員會介紹其全新 Claude・Mythos 預覽版 AI 模型。金融穩定委員會正編撰金融業人工智能合規應用規範報告,計劃下月發佈草案公開徵求意見。金融穩定委員會與 Anthropic 雙方均拒絕對近期雙方溝通事宜置評。(界面)
AI 安全初創公司 Depthfirst 表示,其自研 AI 模型在代碼漏洞檢測方面表現超越 Anthropic 最新模型 Mythos,並以約 1/10 成本發現更多關鍵安全漏洞,引發網絡安全行業關注。據該公司披露,Mythos 上線一個月前曾宣稱在關鍵互聯網基礎代碼中發現大量嚴重漏洞,而 Depthfirst 稱其模型在更低成本(約 1000 美元對比 1 萬美元)條件下,進一步識別出 Mythos 未發現的多個高危漏洞。Depthfirst CEOQasim Mithani 表示,公司通過"單任務優化型 Al 模型“提升漏洞檢測效率,使安全分析成本大幅下降,同時提升覆蓋深度。該公司在今年 3 月完成 8000 萬美元融資,估值達 5.8 億美元,並同步推出“Open Defense Initiative”,向開源開發者與關鍵基礎設施項目提供 500 萬美元 AI 檢測額度,用於漏洞掃描與安全審計。(福布斯)
白宮近日對 Anthropic 提議將其 AI 模型 Mythos 擴展至約 120 家公司表示反對,主要基於安全和算力的考慮。Anthropic 原計劃在現有約 50 家企業的基礎上,新增 70 家公司使用 Mythos,但白宮對此提出質疑,擔心算力不足可能影響政府自身對 Mythos 的使用。Mythos 於 4 月初發布,旨在檢測並利用關鍵軟件漏洞,目前僅限於管理關鍵基礎設施的企業測試,尚無公開發布計劃。白宮擔心,若將使用範圍擴大至更多商業用戶,政府在使用該模型時將面臨算力瓶頸,特別是 Anthropic 與亞馬遜、谷歌和博通簽訂的算力採購協議,儘管已簽約,但新產能尚未上線。政治方面,白宮與 Anthropic 的關係也未見緩和。特朗普政府曾公開批評 Anthropic 招聘了多名拜登政府前官員,並對其與自由派組織的關係表達不滿。一個例子顯示出雙方的信任問題:Anthropic 前研究員 Collin Burns 原本被安排進政府的 AI 模型評估崗位,但白宮高層得知後直接更換了人選,理由是避免 AI 公司人員直接參與與其他 AI 公司打交道的事務。此外,Anthropic 上週還披露了 Mythos 模型的未授權訪問事件,進一步加劇了外界對該公司的監管關注。
Anthropic 與 OpenAI 相繼出現安全事件,引發市場對 AI 模型自身安全性的關注。目前 Anthropic 正在調查其 Claude Mythos 模型可能被用戶未經授權訪問的情況。幾乎同時,OpenAI 也被曝在其 Codex 應用中,意外開放了多款尚未發佈的模型。分析認爲,此類事件凸顯出,即便是主打網絡安全能力的 AI 模型提供商,自身仍面臨較大安全挑戰。在 AI 逐步用於防禦網絡攻擊的同時,其平臺安全與訪問控制問題同樣成爲關鍵風險點。業內觀點指出,這些漏洞事件強化了對 AI 企業安全治理能力的審視,也反映出當前 AI 技術在快速發展過程中,安全體系仍有待完善。(The Information)
據 Decrypt 報道,Mozilla 近日披露,Anthropic 旗下最新 AI 模型 Claude Mythos 在對 Firefox 瀏覽器的內部測試中識別出 271 個安全漏洞,相關漏洞已於本週完成修復。作爲對比,此前另一版本 Anthropic 模型僅發現 22 個安全敏感漏洞。Mozilla 表示,所有被發現的漏洞均未超出頂尖人類研究員的發現範疇。Claude Mythos 於2026年 3 月正式發佈,是 Anthropic 在推理、編碼及網絡安全領域最強大的模型,目前通過"Project Glasswing"計劃限定向亞馬遜、蘋果、微軟等經審覈的合作伙伴開放使用。
Anthropic 因 Mythos 模型具備高度自動化網絡攻擊能力,最終決定限制其公開發布。報道稱,該模型在內部測試中已可獨立完成漏洞發現與利用流程,並生成多步驟攻擊方案。知情人士表示,Mythos 在早期測試中可自主構建針對 Linux 系統的入侵工具,並在引導下完成複雜漏洞鏈攻擊。相關能力被評估爲可能對全球基礎設施構成風險。Anthropic 管理層最終將 Mythos 定位爲網絡防禦工具,並通過受限方式向部分機構開放測試。業內人士指出,類似模型或顯著提升網絡攻防效率,同時也可能帶來新的安全挑戰。(Bloomberg)