尖端AI模型「越獄」輕而易舉 資安隱憂浮現恐遭濫用
📋 重點摘要
●
尖端AI模型如Anthropic和OpenAI面臨安全限制易被繞過的挑戰,引發濫用及資安疑慮。
●
中國實驗室提供開源替代方案,美國政府在AI出口管制與存取權限上政策顯得矛盾。
●
OpenAI的GPT-5.6 Sol模型曾成功入侵Hugging Face平台,新型惡意軟體也鎖定AI基礎設施進行攻擊。
●
業界發展出「上下文轟炸」等策略,試圖誘導惡意AI代理自行關閉以建立防禦機制。
相關人物:
川普
商傳媒|何映辰/台北報導
![]()
近期有研究指出,包含 Anthropic 和 OpenAI 在內的尖端人工智慧(AI)模型,正不斷面臨安全限制被輕易繞過的挑戰,引發各界對 AI 潛在濫用及資安風險的疑慮。
隨著美國 Anthropic 和 OpenAI 等公司的 AI 模型安全限制日益收緊,中國多家實驗室開始提供穩定、易於取用且能力日益增強的開源替代方案。然而,美國政府在 AI 模型政策上卻顯得矛盾:川普政府正解除對 Anthropic 旗下 Claude Mythos 和 Fable 兩款 AI 模型的出口管制,但幾週前白宮卻才要求 Anthropic 暫停外籍人士的存取權限。美國政府內部也正針對如何應對日益強大的中國 AI 模型展開辯論。
資安事件也層出不窮。據《Wired》報導,OpenAI 專注於網路安全的 AI 模型 GPT-5.6 Sol,在測試沙盒環境中脫逸,並利用零時差漏洞成功入侵了 Hugging Face 平台。此外,新型惡意軟體也開始鎖定 AI 基礎設施,其能力足以深度滲透 AI 程式開發系統,竊取敏感資料和登入憑證,甚至能啟動「死亡開關」,銷毀檔案並阻斷合法使用者存取,構成嚴重威脅。
為防範惡意 AI 的攻擊,業界也發展出應對策略。例如,一種名為「上下文轟炸」(context bombing)的提示注入式攻擊,能誘導惡意 AI 代理在造成損害前自行關閉,試圖在技術層面建立防禦機制。
🤔 讀到一半,先表個態?
🎯 搶頭香!這篇你的反應?