Broadcom推VMware AI Factory 加速企業AI模型落地私有雲
Broadcom(博通)於 VMware Explore 2026 大會上宣布推出 VMware AI Factory,此為 VMware Private AI Cloud 的軟體定義基礎,旨在簡化企業人工智慧(AI)的部署流程,並加速從裸機伺服器到運行第一個 AI 模型所需的時間,從數週縮短至數小時。
VMware AI Factory 透過自動化基礎設施部署、統一生命週期管理,並讓企業能自由選擇偏好的硬體及已驗證模型,以更有效率的方式管理 AI 成本。此平台能整合並共享組織內的繪圖處理器(GPU)資源,讓多個模型可在共享硬體上運行。此外,其整合式模型庫提供單一介面,便於部署與管理虛擬機器(VM)、容器及 GPU 資源上的模型推理和檢索增強生成(RAG)工作流程。
Broadcom 也宣布,其核心產品 VMware Cloud Foundation(VCF)現已通過驗證,可運行來自 Google、輝達(NVIDIA)、NEC、阿里雲(Alibaba Cloud)與智譜(Z.ai)等領先供應商的頂級 AI 模型。這使得企業能將 AI 模型部署到內部環境,以「模型即服務」的形式提供給用戶。外媒指出,越來越多企業將 AI 推理工作負載轉移到私有雲,主要考量包括資料隱私、安全性、治理,以及 AI Token(模型運作時消耗的計算單位)成本等因素。根據 Broadcom 的《2026 私有雲展望》報告,有高達 56% 的企業已在或計畫在私有雲上運行生產級 AI 推理。
VMware Cloud Foundation 作為一個統一的私有雲平台,不僅能運行推理工作負載、智慧代理應用程式及容器化服務,還能同時運行傳統虛擬機器。獨立基準測試 MLPerf Inference v5.1 證實,VCF 提供的效能可媲美裸機運行。該平台支援超微半導體(AMD)、英特爾(Intel)和輝達等多元運算架構,讓企業可依需求選擇 GPU 與中央處理器(CPU)硬體。透過 vLLM 作為預設模型運行環境,客戶能在 VCF 上運行超過 150 種開源模型。
此波驗證的 AI 模型包括輝達的 Nemotron 3 模型系列、Google DeepMind 的開源多模態模型 Gemma 4、NEC 專為日語優化的 cotomi 模型、阿里雲的 Qwen3.8-27B 視覺語言模型,以及智譜的開源通用語言模型 GLM 5.2。這些模型各有專長,例如 Nemotron 3 善於代理工作流程,Gemma 4 支援自主 AI 代理,cotomi 提升日語理解與 Token 效率,Qwen3.8-27B 適用於程式開發與多模態互動,GLM 5.2 則專為本地部署的程式編寫與推理代理打造。
為強化私有 AI 基礎設施,Broadcom 正與 MetalSoft 合作,將異構裸機的自動化功能整合至 VMware Cloud Foundation,可將裸機配置時間從數週縮短至數分鐘。此舉讓 IT 人員能直接透過 VCF 管理主控台,對來自多家供應商的實體伺服器進行配置或重灌。此外,VMware AI Factory 將結合 VMware Cloud Foundation 與戴爾PowerEdge伺服器,以及思科(Cisco)、聯想集團(Lenovo)、美超微(Supermicro)等廠商提供的 VCF AI ReadyNodes 解決方案。Broadcom 也與超微半導體深化合作,將 VCF 與 AMD Instinct GPU 及開放的 AMD ROCm 軟體生態系整合,為客戶提供更廣泛的硬體選擇。
Broadcom 雲端基礎事業部全球 AI 與進階服務主管 Chris Wolf 表示,公司致力於為企業提供最廣泛的 AI 模型,並在 VCF 上進行驗證,以確保企業能以具成本效益的方式,部署安全且可規模化的 AI 服務,並實現資料主權。