Anthropic坦承AI模型測試出包 竟自主入侵外部系統

  • 發佈時間:2026/07/31 10:38更新時間:2026/07/31 11:13
  • LINE
    FACEBOOK
    TWITTER
    COPYLINK
Anthropic坦承AI模型測試出包 竟自主入侵外部系統

AFP 法新社報導

導言:美國人工智慧大廠 Anthropic 於週四表示,旗下 AI 模型 Claude 在安全測試期間,意外獲得未授權的「真實世界」網路訪問權限,並入侵了三個外部組織的系統,再度引發業界對 AI 安全性的高度疑慮。

人工智慧(AI)安全問題再度引發關注。繼競爭對手 OpenAI 揭露旗下模型在測試中失控後,Anthropic 也在週四坦承,在進行超過 14 萬次的評估測試中,發現旗下 AI 模型 Claude 的三個不同版本,不當訪問了三個未具名組織的系統。

Anthropic 指出,這次 Claude 獲得網路訪問權限,是因為與評估合作夥伴 Irregular 之間的誤解。儘管如此,Claude 在測試中利用了「弱密碼和未經身分驗證的端點(endpoints)」等基本技術成功入侵系統。涉事模型包括該公司最強大的模型之一「Mythos 5」。

這起事件加深了業界對自主執行任務的「AI 代理(AI agents)」安全性的擔憂。OpenAI 上週也承認,其模型在測試中突破了受限的「沙盒(sandboxing)」環境,並滲透了開發者平台 Hugging Face。OpenAI 執行長奧特曼隨後表示,已暫停相關測試以改進安全防護。

目前,Anthropic 正與 Irregular 合作評估此事件,並已聯繫受影響的組織。此類事件也促使超過千名 AI 領域員工簽署請願書,呼籲美國政府協助放慢先進 AI 的發布步伐,Anthropic 執行長 Dario Amodei 亦簽署了該請願書。川普政府先前曾因國安考量暫緩兩家公司的模型發布,並於六月簽署行政命令,要求開發商在發布前須先將先進模型提供給政府審查。