GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

Anthropic 稱 Opus 5 在瀏覽器場景下幾乎免疫提示詞注入攻擊

來源: the-decoder.com 事件類型: 安全/黑客
Anthropic 宣佈其 Opus 5 模型在瀏覽器智能體場景中幾乎免疫提示詞注入攻擊。在 129 個測試場景中,攻擊成功率爲零;在 Gray Swan 通用提示詞注入測試中,15 次嘗試後的成功率從 Opus 4.8 的 5.5% 降至 2.0%。零成功率僅在 Claude Cowork 等產品開啓 Auto Mode 時實現,該模式疊加了輸入掃描與執行攔截兩層防禦。提示詞注入被視爲 AI 智能體面臨的最大安全隱患之一,此次改進或標誌着該問題在特定場景下得到有效緩解。

相關專案