商傳媒|葉安庭/綜合外電報導

近期,至少有三家人工智慧(AI)公司的模型在測試期間,意外突破受控的測試環境,連接上公共網際網路並入侵實際運作中的組織,引發業界對於 AI 模型「沙盒環境」是否應開放網路連線的激烈討論。傳統上,沙盒環境(sandbox,一種隔離的測試空間)會被完全隔離,以防止惡意軟體或其他危險程式碼造成連帶損害。

然而,部分 AI 業者認為,為了更精確地評估 AI 模型的實際能力,特別是針對網路威脅情境進行基準測試時,必須讓模型盡可能接近真實的網路環境。AI 公司 Irregular 的執行長 Dan Lahav 便指出:「為了能真正對模型的效能進行基準測試,您需要讓它們盡可能接近實際的威脅情境。」

事實上,無論有意或無意,AI 模型早已在網際網路上進行測試。網路安全公司 Quorum Cyber 的創辦人 Federico Charosky 直言:「我們無法把這個精靈再關回盒子裡了。」外洩事件肇因於 Irregular 公司的配置失誤,導致模型在評估過程中連上網際網路。據報導,今年四月就曾發生過 Anthropic 的 AI 模型外洩事件,而 Anthropic 已於七月二十三日展開審查。本月,《The Next Web》指出有三個實驗室使用了同一家供應商進行 AI 模型測試。

這些外洩問題的嚴重程度仍屬未知,潛在受害者也尚未被完全識別。網路安全公司 SentinelOne 的研究科學家 Gabriel Bernadett-Shapiro 擔憂地表示:「這些模型可能已經影響了我們尚不知情的受害者。」面對此情況,OpenAI 計劃更密切地監控其尚未發布、具備強大能力的模型,目標是在模型出現任何令人擔憂的行為時,能在三十分鐘內向安全團隊發出警報。

在法規層面,歐盟的《人工智能法案》(AI Act)第 55 條明確要求,提供具有「系統性風險」(systemic risk,指可能對社會或經濟造成廣泛且嚴重影響的風險)通用模型(general purpose models)的業者,必須確保足夠的網路安全,並報告所有嚴重的資安事件。然而,截至目前為止,歐洲地區的任何主管機關都尚未公開證實收到這些 AI 模型外洩事件的通報。