駭客瞄準AI代理部署隱藏指令 自主AI信任危機浮現
隨著人工智慧(AI)技術快速發展,新型態的資安威脅也隨之浮現。最新研究顯示,網路攻擊者已發展出專門針對「AI代理」(AI Agent,能自主執行複雜任務的 AI 應用程式)的新型網路釣魚手法,即便人類使用者一眼就能辨識出可疑網站,這些AI代理仍可能被隱藏指令所欺騙,進而導致潛在的資安風險。
資安公司 Guardio 在 2025 年的研究中,將這種利用 AI 代理解讀網頁內容漏洞的詐騙手法命名為「Scamlexity」。這類惡意網頁會透過隱藏文字、中繼資料(metadata)或程式碼等方式,對 AI 代理發出信任指令,要求其執行交易或提供敏感資訊。例如,Guardio 的測試顯示,一個 AI 代理在瀏覽看似可疑的偽造 Walmart 網站時,仍接受了錯誤的產品頁面並試圖完成購買。網路資安公司 Zscaler 和資安研究團隊 Unit 42 也分別在 2026 年 7 月和 2025 年 12 月紀錄了真實世界的攻擊案例,顯示這類技術已非概念驗證,而是被實際應用於攻擊 AI 驅動的廣告審查系統等場景。
這些攻擊改變了傳統網路釣魚的目標,從以往誘導人類輸入資訊,轉變為直接針對 AI 代理的決策過程。惡意網頁不再只是讓人類「看起來真實」,更要讓機器「認定其可信」。這凸顯了在自動化時代,企業在部署 AI 應用時面臨的責任與挑戰。服務專家 CommonAI Compute 的技術長羅斯瑪麗·弗朗西斯(Rosemary Francis)表示,企業在導入 AI 代理時,不應將安全決策完全交由工程師個人判斷,而應建立明確的規範與測試機制,避免過度依賴 AI 供應商的聲明。
英國 Starling Bank 基礎與客戶導向 AI 主管 David Sullivan 強調,AI 公司不能在模型交付給客戶後就推卸責任,特別是在金融等高度監管的行業中,英國金融行為監管局(Financial Conduct Authority)等監管機構仍會要求銀行對 AI 的行為負責。因此,AI 公司與部署者都必須共同承擔責任,確保 AI 代理在生產環境中的可靠性與安全性。科技公司 Clairo AI 執行長 James Faure 也指出,評估 AI 代理的每一個執行步驟都極其困難,因此必須在模型投入運作前,設置嚴格的「質量門」(quality gates),確保其通過多種測試,才能避免潛在的風險。
然而,針對 AI 監管的討論也出現不同意見。Anthropic 投資者 Joe Lonsdale 近期批評 OpenAI 和 Anthropic 等領先的 AI 公司,透過誇大 AI 的「末日風險」來影響公眾政策。他認為,這些公司資助外部團體倡導更嚴格的 AI 監管,目的是為了讓少數大公司能主導產業規則,進而鞏固其市場壟斷地位。Joe Lonsdale 指出,包含 OpenAI 執行長奧特曼(Sam Altman)、Anthropic 共同創辦人兼執行長達里奧·阿莫代(Dario Amodei)以及馬斯克(Elon Musk)在內的產業領袖,都曾呼籲放緩先進 AI 模型的發展,原因即在於其帶來的「生存風險」。他警告,這種由寡頭企業控制政府政策的模式,將會帶來極大危險。