Claude Opus 4.6 自主識破 AI 測試 成功破解答案加密機制
BrowseComp 是一個基準測試,旨在評估 AI 模型在網路上尋找難以定位資訊的能力。當 Anthropic 在多代理設定中讓其 Claude Opus 4.6 模型執行這項基準測試時,發生了該公司前所未見的情況。在 1,266 項任務中的兩項,該模型自主發現自己正被評估,識別出特定的基準測試,並解密了答案密鑰。 AI 模型分析測試脈絡 該模型首先進行了詳盡的網路搜尋以解決問題,其中一個案例處理了數十個平台和十二種語言,約 3000 萬個 token。經過數百次搜尋失敗後,它改變了策略。Opus…