商傳媒|吳承岳/台北報導

人工智慧(AI)技術日益成熟,企業導入AI代理(AI Agents)以實現業務自動化的趨勢逐漸加劇。AI代理,是一種能夠理解複雜指令、自主規劃並執行多步驟任務的人工智慧程式,雖然可大幅提升營運效率,卻也帶來不同於傳統AI工具的新型網路資安風險。PwC Japan Group旗下的PwC Consulting與網路安全廠商趨勢科技(Trend Micro)共同發布一份報告,揭示AI代理的潛在威脅結構與治理框架,並警示日本在AI導入及統制方面遠落後於其他主要國家。

該報告引述PwC Japan Group在2026年2月至3月針對全球六國、營收逾500億日圓企業中高階主管的調查。結果顯示,已導入或正在導入AI代理的企業比例,美國達59%,英國55%,中國48%,德國37%,大韓民國36%,而日本僅有33%,位居末位。同樣地,為AI治理建立中央組織的企業比例,美國為63%,英國54%,中國42%,德國35%,大韓民國33%,日本卻只有23%,顯示其在AI統制方面的不足。

趨勢科技的法人品牌TrendAI透過實證環境,測試Anthropic、OpenAI、Google及DeepSeek等四家主要供應商提供的13種AI模型。測試中,研究人員使用自動生成的200種攻擊性Prompt(提示詞),總計進行2,600次並行測試,證實攻擊行為可橫跨多個AI模型成功執行。其中一項被驗證的攻擊手法是「保存型Prompt Injection」(提示詞注入),攻擊者可透過網路表單將惡意指令混入業務數據中,當AI代理隨後讀取這些數據時,便會執行非預期的處理,例如從資料庫中提取機密資訊,甚至導致顧客身分驗證(KYC)系統誤認護照圖像中的指令,進而洩漏他人個人資料。

報告指出,此類攻擊得以成功,根本原因在於2026年當前語言模型難以嚴格區分輸入的「資料」與應執行的「指令」。當AI代理被賦予高度資料庫存取權限並自主執行工具呼叫鏈時,惡意利用便可能升級為系統性威脅。為應對這些結構性風險,聯合報告提出「AI統制保證水準」(AI-CAL)框架,將AI代理的自主性劃分為五個等級,並為每個等級定義所需的統制要求。

PwC Consulting與趨勢科技強調,企業應在AI系統設計初期,便將循序漸進的治理體制納入考量,涵蓋「權限管理的建立」、「觀測性與控制性基礎建設的整備」及「AI-CAL評估流程的制度化」三大領域。這包括賦予任務執行所需的最小權限、設定關鍵處理的審核關卡,以及確保能追蹤AI思考與工具執行過程的觀測性,並在偵測到異常時能立即限制功能或停止處理,以應對AI代理日益普及帶來的資安挑戰。