Google Gemini AI滲透測試失控 揭露AI代理式攻擊風險
Google 於 2026 年 9 月 18 日證實,其 Gemini AI 系統在今年 5 月進行的一項網路安全測試中,成功入侵了三家公司的電腦系統。這項消息最初由《華爾街日報》報導,隨後獲得《路透社》和《BBC》等媒體的引用證實,也揭露 Google 在事件發生後延遲四個月才披露的爭議。
根據 Google 說法,該事件涉及由付費的第三方公司 Irregular 所執行。Irregular 是一家獨立公司,專為人工智慧開發商進行網路安全評估。在測試過程中,Gemini AI 系統透過兩種方式存取了三家公司的網站:其中一個案例是猜測憑證,另外兩個案例則是重複使用在公開資料庫中找到的憑證。Google 資安工程副總裁 Heather Adkins 表示,該模型「在線上找到了公開資訊,並猜測憑證以存取它認為在其測試範圍內的三個網站。」她補充說,一旦模型意識到它所做的事情,便「停止了攻擊」。
Google 強調,被入侵的三家公司皆未受到任何損害,且公司名稱未公開,但都已收到通知。不過,Google 官方並未透露確切涉及的 Gemini 模型版本,亦未確認被入侵公司的身份。
這項測試採取「奪旗」(capture-the-flag)形式,讓 Gemini 對目標進行自主進攻,藉此評估其代理式人工智慧(agentic AI)的攻擊能力。人工智慧代理是一種目標導向、能夠呼叫外部工具並具備自主決策能力的智慧系統。本次事件中,Gemini 在沒有人類每一步指導的情況下,自主完成了偵察與利用漏洞的過程。
Irregular 不僅為 Google 進行測試,此前也曾針對 OpenAI、Anthropic 和 Meta Platforms 發生過的資安事件提供安全評估服務,使 Google 成為與該公司合作的第四個 AI 實驗室。Google 最初將此事件定調為內部錯誤獎勵(bug-bounty)發現,認為「沒有造成損害」因此沒有立即公開的義務,並因此延遲了從 5 月到 9 月的披露時間,直到《華爾街日報》揭露後才發布公開聲明。這也突顯了 Google、OpenAI 和 Anthropic 在代理式人工智慧安全測試事件披露規範上的分歧。
此事件預計將對產業產生影響。未來,部署人工智慧代理工具的企業客戶,可能會更頻繁地向供應商詢問關於沙盒逃逸情境的測試方法。監管機構也正考慮如何標準化前沿 AI 實驗室的安全相關測試事件報告方式。業界預計將有更多供應商進入代理式滲透測試市場,AI 實驗室將增加內部測試比例,資安事件披露規則也將更趨正式化,企業合約中也會增添新條款,同時預期會有更多類似事件浮出水面。