【信報財經新聞】美國人工智能(AI)企業OpenAI和Anthropic的AI模型再捲入網絡安全事件,英國人工智能安全研究所(AISI)表示,在一項涉及互聯網接入的網絡安全評估中,Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol模型,持續針對真實個人和組織實施可能造成危害的活動。
AISI稱,在注意到異常數據傳輸後,於7月28日發現有關事件。調查發現,在評估過程中,其中一個AI模型試圖向GitHub上的一個開源軟件項目植入有害代碼,甚至創建虛假身份來推動代碼獲得批准。一名人工維護者發現並拒絕批准惡意代碼。
Anthropic在社交平台X上發表聲明稱,在進行內部調查的同時,正與AISI密切合作,以收集更多關於此事的細節。通過審查Claude的推理記錄並開展內部分析,全面了解Claude對自身所處環境的理解,將有助於查明其行為原因。
OpenAI亦表示,感謝AISI在整個過程中的合作,包括識別、調查並分享相關活動細節;期待雙方繼續開展合作。
此外,OpenAI還披露,另一宗網絡安全事件發生在與外部網絡安全公司Irregular聯合開展的AI模型評估中。在這次事件中,其模型在接受另一項網絡安全評估時,利用測試環境中的一項配置錯誤接入互聯網,並利用了網站漏洞。這些新披露的事件與此前公開的涉及Hugging Face的案例無關。Irregular也是Anthropic的合作夥伴。