商傳媒|何映辰/台北報導

人工智慧公司 Anthropic 的 Claude Code 部門主管 Boris Cherny,近日深入探討了旗下最新 AI 模型 Opus 5 的開發過程,以及其人工智慧工具 Claude Code 的演進。他不僅揭露了 Anthropic 獨特的開發哲學,更強調釋放模型潛力的重要性。

Anthropic 已於近日推出最新 AI 模型 Opus 5,該模型在效能與功能上皆有顯著提升。根據《StartupHub.ai》報導,Opus 5 在 Arc AGI 基準測試中取得了 30% 的分數,相較於先前個位數的表現,可謂一大躍進。Cherny 指出,結合「自動模式」的 Opus 5,能在無外部干預下持續運作數日、數週甚至數月之久。

Opus 5 另一項關鍵進展是其對 Prompt Injection(提示詞注入)的抵抗能力,這項特性自 Opus 4.7 版本便已具備。Anthropic 透過長達三年的對齊(alignment)研究,並結合提示詞注入分類器及自動模式分類器,有效提升模型面對惡意提示詞攻擊時的防禦力,確保其按照預期執行任務。

Anthropic 採行一種稱為「刪除」的開發哲學來更新 Claude Code,意即在每次推出新模型時,都會徹底刪除並從零開始重建程式碼與提示詞。Cherny 解釋,這項在研究中亦稱作「消融」(ablation)的做法,是將整個系統提示詞(system prompt)移除後,再逐行重新引入。由於 Opus 5 的智慧程度大幅提升,它已能內在理解許多過去需要明確指令才能執行的行為,因此高達 80% 的舊有系統提示詞得以被刪除。Cherny 也鼓勵用戶自行設定系統提示詞,或利用未公開的 claude code simple=1 功能,直接移除所有系統提示詞,包括工具相關的提示詞,以觀察模型在不同參數下的行為。

Cherny 提出「解放 Claude」(unhobbling Claude)的概念,旨在移除產品設計上對 AI 模型潛力的限制,他稱之為「產品過剩」(product overhang)。這表示現有模型具備未實現的功能,卻因為產品設計限制了模型的發揮。他舉例,原版建基於 Sonnet 3.5 的 Claude Code 是一款出色的程式開發模型,但當時的產品僅提供單行自動完成或唯讀的聊天互動,未能完全釋放其潛力。因此,Claude Code 的願景是創建一個工具,能讓模型編寫完整的檔案與功能,從而釋放其「產品過剩」的價值。Cherny 認為,對於新創公司而言,這是一個巨大的機會,可以識別並利用當前模型中未被滿足的潛力。他建議創業者應挑戰模型,讓它們執行超出預期能力的任務,並設定好防護措施與退出標準後,再讓模型「自行運作」。

事實證明,曾有用戶僅透過正確的提示詞,就發現 Opus 5 能夠運用 OpenCV 繪製圖像,進而創作出人像和風景畫作。Cherny 指出,對於許多任務而言,程式開發已逐漸「解決」,剩下的挑戰主要集中在高度複雜的系統程式碼和分散式系統。他更引發思考:是否所有程式都能由 AI 代理(Agent)來完成?Cherny 最後強調,最有效率的 Claude 用戶是那些採取實證方法、捨棄對舊模型固有認知,並透過實驗來理解當前模型行為的人。他建議電腦科學學生,除了理論知識外,應透過新創公司或個人專案來學習實際應用,並將電腦科學技能與商業敏銳度、使用者洞察及資料科學知識相結合,才能創造真正的價值。