國際產經:AI安全風險升溫,Anthropic與OpenAI皆曝測試漏洞
財訊新聞 2026/07/31 14:23

【財訊快報/劉敏夫】外電報導指出,Anthropic PBC表示,其人工智能模型在網路安全測試中出現差錯,侵入了三個外部組織。而就在一週多之前,其主要競爭對手OpenAI也披露過類似事件。
Anthropic週四在部落格發文指稱,公司在對其網路安全測試進行審查後發現了這一問題,此前OpenAI宣布了一起安全漏洞事件。根據Anthropic的部落格文章,在OpenAI和Anthropic的測試中,人工智能模型都能夠從本應封閉的測試環境中訪問互聯網。
Anthropic表示,他們審查了141,006份評估測試報告,發現Claude AI工具曾三次訪問互聯網並入侵「外部組織的實際基礎設施」。該公司指稱,最早的一次可以追溯到4月。但是該文並未提及受影響的組織名稱。
Anthropic公司的模型未經授權訪問這三個組織時,將每次訪問都看成了一次演習。這些測試是「奪旗」評估,模型透過入侵其他系統來尋找隱藏訊息,是測試人類和人工智能駭客能力的一種常見方法。
然而,較早版本的模型即使獲得了其正運行於開放互聯網環境中的證據,仍繼續發動攻擊。根據這篇部落格文章,Anthropic最新版本的模型在識別到自己處於互聯網環境後,就停止了攻擊。
