Anthropic 公佈 Opus 5 近乎免疫提示注入 瀏覽器攻擊成功率降至零
人工智能初創 Anthropic 近日公開其最新 AI 模型 Opus 5 的安全表現,指出該模型在自家軟件環境中幾乎完全免疫提示注入(prompt injection)攻擊。提示注入是一種繞過 AI 模型指令的攻擊手法,攻擊者可透過網頁上的隱藏文字等操縱輸入內容,誘使模型偏離原定行為。據官方系統卡資料,Opus 5 在 129 項針對瀏覽器代理的測試場景中,攻擊成功率錄得零百分比,而 OpenAI 去年 12…