Baseten 聯手 Hugging Face、Goodfire AI 強化開放 AI 模型安全
📋 重點摘要
●
Baseten 旗下 Base Labs 與 Hugging Face、Goodfire AI 合作,共同建立開放權重 AI 模型安全評估與監測基礎設施。
●
此合作旨在提升開放 AI 模型透明度與可測量性,並防堵移除內建安全控制的技術。
●
業界擔憂開放模型安全性,Hugging Face 平台上已有大量模型被應用移除安全防護的技術。
●
Baseten 認為開放性是 AI 安全優勢,能轉化為實用透明的控制機制。
●
三家公司期望打造兼具可及性、高層次控制與安全性的開放模型生態系統,並呼籲社群參與。
商傳媒|責任編輯/綜合外電報導
![]()
人工智慧(AI)基礎設施公司 Baseten 旗下研究部門 Base Labs,近日宣布與 Hugging Face、Goodfire AI 展開合作,共同建立評估與監測開放權重人工智慧模型(open-weight AI models)安全性的基礎設施。這項合作旨在提升這些模型的透明度、可測量性,並使其在部署後更難以移除內建的安全控制。
目前 AI 業界正熱烈討論開放權重模型的安全性問題,尤其是有關「abliteration」(一種移除模型內建安全防護的技術)的應用。據報導,Hugging Face(一個知名的開放原始碼人工智慧模型平台)上已有超過 6,000 個模型曾被應用此類技術。為此,Base Labs 將專注於開發與發布開放模型的訓練及監測方法。
Baseten 強調,開放性對於 AI 安全而言是一大優勢,因其能提供更多機會觀察模型行為,並將安全研究轉化為實用且透明的控制機制,而非僅在後期附加安全功能。Goodfire AI(一家專注於提升人工智慧模型可解釋性的公司)也指出,安全性必須從一開始就內建於開放模型之中,並由操作者確保執行。
這三家公司希望透過此次合作,能打造出一個兼具可及性與高層次控制、安全性的開放模型生態系統。他們也呼籲廣大開發者社群能共同參與,一同塑造這項新方法,以推動負責任的人工智慧發展。
🤔 讀到一半,先表個態?
🎯 搶頭香!這篇你的反應?