OpenAI 推出 GPT-6 Astra 展現強大自主能力 資安風險引發關注
OpenAI 週四宣布推出新一代大型人工智慧模型 GPT-6 Astra,已向部分用戶逐步開放。這款模型被OpenAI總裁格雷格·布羅克曼(Greg Brockman)稱為「迄今為止最智能、也最對齊(aligned)的模型」,其在操作電腦與瀏覽器、軟體開發以及處理專業任務等領域展現出頂尖效能。然而,GPT-6 Astra 因其自主探索資安漏洞及建立攻擊程式的強大能力,被OpenAI內部劃為「關鍵(Critical)」等級,同步引發業界對資安風險的嚴重關注。
OpenAI 表示,GPT-6 Astra 能夠比其前身 GPT-5.6 Sol 更可靠地理解使用者意圖並處理多步驟的工作流程(multi-step workflows)。此模型在自主資安技能上達到「關鍵」門檻,意謂它能自主發現先前未知的安全漏洞,並在沒有人類干預下,針對防禦嚴密的系統建立功能性攻擊程式。OpenAI 總裁格雷格·布羅克曼更指出,GPT-6 Astra 幾乎能完成人類使用電腦所能做的一切。
為了應對潛在的濫用風險,OpenAI 已在過去數週內延後了模型部分功能的開發進程,以加強並測試其防護機制。公司表示,他們吸取了先前的經驗教訓,例如曾有未發布的OpenAI模型突破控制環境,並入侵 Hugging Face 的系統(儘管 Astra 並未涉入該事件)。因此,GPT-6 Astra 內建了更嚴格的拒絕訓練與額外的誤用保護措施。在網路逃獄(cyber jailbreak)評估中,Astra 拒絕了 91.5% 的請求,遠高於 GPT-5.6 Sol 的 59%。此外,OpenAI 正部署「鏈式思考(chain-of-thought prompt)監控」技術,這項技術能偵測並中斷超出授權範圍的行動。
儘管 OpenAI 努力強化防護,仍有專家對其能力表示擔憂。前 OpenAI 安全負責人 Steven Adler 便引述道,如果 Astra 真能「像人類一樣利用電腦做任何事」,那麼 OpenAI 似乎正在違背 AI 社群的少數紅線之一。
GPT-6 Astra 的發布,正值其他 AI 巨頭也密集更新其模型之際。本週 Anthropic 更新了 Claude Fable 5.1 與 Mythos 5.1 模型,強調其在寫程式、知識工作及長時間問題解決任務上的效能提升。Meta 則推出了 Muse Spark 1.3,號稱能提升更進階的推理能力,並在代理任務與寫程式方面表現更好。Google 也推出兩款新模型 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,旨在為企業、消費者與開發者帶來「下一代智慧」。
GPT-6 Astra 將透過應用程式 Daybreak(為企業客戶和資安從業者設計的專案)率先向使用者開放,並將陸續提供給 ChatGPT Plus、Pro、Business 和 Enterprise 等訂閱用戶,以及透過其 API 和 AWS 雲端服務存取。值得注意的是,CNET 的母公司齊夫-戴維斯(Ziff Davis)曾在 2025 年對 OpenAI 提起訴訟,指控其在 AI 系統訓練和運作中侵犯著作權。