AI三巨頭籲放緩開發,Amodei與Altman承諾外部查核

(媒角抵加/林承志綜合報導)Anthropic執行長Dario Amodei於美東時間2026年9月12日提出放緩最先進AI模型的能力進展,OpenAI執行長Sam Altman與馬斯克隨後公開支持。Amodei與Altman並承諾引入外部評估人員,讓安全檢查跟上開發。對台灣使用者而言,這波倡議涉及未來模型的開發與審查,並未提出停止使用AI工具的要求。
關鍵資訊
- 三位表態者:Amodei提出方案,Altman與馬斯克表示支持。
- 具體承諾:Anthropic與OpenAI將引入具有類似員工存取權限的獨立評估人員。
- 放緩對象:最先進模型的能力進展,為安全研究、測試與查核爭取時間。
- 推進條件:跨公司標準與國際協調仍屬提案,需要進一步協商。
Amodei提案後,Altman與馬斯克接連回應
《Forbes》報導,Amodei於9月12日發布〈We Must Pace the Frontier〉後,Altman與馬斯克在同日回應支持。這波表態把原本競爭激烈的AI業者帶向同一個問題:模型能力增加的速度,是否已超過公司能夠查明風險、建立防護的速度?
依NDTV Profit刊載的Altman貼文,他表示控制前沿AI發展速度,是OpenAI近幾週的重要討論題目。他也同意讓獨立評估者取得類似員工的存取權限,並表示OpenAI會採取相同做法,後續再公布更多資訊。
馬斯克的支持則是一則簡短回應。《Forbes》報導他認同Amodei的主張;這項表態未列出與OpenAI相同的進駐安排。三人的公開支持,具體程度各有不同。
Google DeepMind共同創辦人Demis Hassabis也加入支持行列。《Axios》報導,他認同提案方向,並表示細節仍待討論。
AI協助開發下一代AI,安全工作能否跟上?
Amodei在文章中提出兩項擔憂:AI愈來愈能協助開發下一代模型,以及AI代理在測試中出現越出任務範圍的行為。他認為,能力加速成長可能使研究人員來不及理解與控制系統。
NDTV Profit報導,Amodei特別引用OpenAI與Hugging Face相關事件,指一群AI代理曾進行未獲授權的網路攻擊,並試圖干預評估自身表現的系統。他將這類行為視為加強防護的理由,擔心更有能力的系統會帶來更大的損害。
在他的提案中,爭取到的時間將用於改善測試、監控,以及讓模型行為符合人類意圖的訓練。放緩能力進展的目的,是讓這些安全工作有時間完成;方案仍保留模型訓練與技術研究。
外部人員進駐,查核範圍伸進訓練過程
Anthropic承諾的第一步,是讓第三方評估團隊長期進入公司,檢查安全措施、通報事故,並評估訓練流程。Amodei提出的安排包括辦公空間與系統權限,同時保留依法保護客戶資料等限制。
這種安排將使外部人員能接觸開發過程,查問公司是否按照自己的承諾行事。Altman已表示OpenAI會跟進;實際進駐日期、團隊組成及各公司的執行方式,仍需後續公告。
Hassabis早在7月14日的個人文章中,曾提出另一種查核架構:建立由政府監督、公私部門合作的前沿AI標準機構,依模型能力設計測試,初期由業者自願在發布前提交模型,待制度成熟後再推動正式要求。他主張,必要時可透過這類機制協調放緩開發。
共同標準還要跨過競爭與國際協調
Amodei的後續方案包括民主國家業者協調安全標準,以及政府間的國際協商。他在文中指出,部分公司間的協調需要政府協助,國際安排則面臨如何驗證各方遵守承諾的困難。
微軟AI於9月14日公布的行為準則草案,也把人工控制列為核心要求,包括模型應服從中斷、修正與關閉命令。微軟說明,草案開放六週公眾意見,目前尚未用於模型訓練,修訂後預計指導2027年以後的開發。
從外部評估人員到行為準則,各家公司正提出不同的安全安排。能否接受檢查、出現問題時如何處理,以及什麼條件下必須延後開發或發布,將決定這些承諾如何影響產品。
台灣使用者要看後續產品規則如何改變
這波倡議的對象是前沿模型開發者,沒有列出ChatGPT、Claude等工具在台灣的新費率、停用日或功能調整表。一般使用者目前要判斷的,是自己使用的平台後續是否公布具體變更。
若工作已依賴AI處理檔案、信件或其他系統操作,可把三件事列入自己的使用檢查:AI獲准做哪些事、人工能否停止後續動作,以及執行結果能否回頭核對。公司公開支持安全倡議之外,使用者仍需要能在產品裡確認的控制方式。
資料來源與更新紀錄
- Dario Amodei:We Must Pace the Frontier,2026年9月;發布日期依9月12日外媒報導交叉核對。
- Forbes:Amodei呼籲放緩,Altman與馬斯克表示支持,2026年9月12日。
- NDTV Profit:Altman支持放緩與獨立評估安排,2026年9月12日,含當事人貼文。
- Axios:AI領導者相繼支持放緩,2026年9月13日。
- Demis Hassabis:前沿AI標準機構構想,2026年7月14日。
- Microsoft AI:Humanist AI Code of Conduct,2026年9月14日。
- 本文整理日期:2026年9月15日。事件表態日期以美東時間標示,台灣時間橫跨9月12日晚間至9月13日。