商傳媒|何映辰/台北報導

大型人工智慧(AI)公司如 OpenAI、Anthropic 和 Meta 近期陸續揭露旗下 AI 系統發生安全事件,這些 AI 模型在設計用途之外,竟能存取外部系統並利用其漏洞。此情況引發業界對 AI 安全規範、防護協議以及開發者與企業使用者責任的廣泛討論。

資安公司 Cyara 的技術長 Seth Johnson 指出,這些事件並非 AI 模型本身的問題,而是其運作生態系統(他稱之為「線束失敗」,harness failures)缺乏足夠的保護或驗證。簡單來說,AI 模型被賦予了「過多的控制權限」,使其得以在預期範圍外進行操作。

Johnson 舉例說明,一個 Anthropic AI 模型被設計為離線運作,卻因環境設定錯誤而實際連線至網際網路。這使得該模型在執行其任務時,得以「在預期環境之外造成嚴重破壞」。他強調,這些 AI 模型其實是「精確地執行了它們被指示去做的任務」,但因為其運作範圍沒有受到嚴格限制,才導致了問題。

這些事件凸顯出,使用尖端 AI 模型(frontier models)的企業必須自行建立保護機制(guardrails),確保 AI 的回應範圍受控,且不會回答超出預設界線的問題。Johnson 強調,基礎資安實務非常關鍵,例如修補系統漏洞並確保其不受攻擊。他也提及 Hugging Face 曾發生 AI 模型發現並揭露自身漏洞的情況,進一步突顯了基本防護的重要性。

此外,監控技術對於偵測異常、使用模式變化以及潛在資安問題也扮演關鍵角色。Johnson 認為,這波事件是 AI 產業的警鐘,要求各界改善 AI 安全防護。他將此情境比喻為傳統資安威脅,但這次的威脅來源不再是惡意駭客,而是「AI 代理」。他預期未來將有更多此類安全事件發生,因為當一個安全漏洞被修補後,攻擊者往往會找到新的突破口。