AI基準測試潛藏盲點 模型評價仍需仰賴實證檢驗
商傳媒|葉安庭/綜合外電報導人工智慧模型的基準測試常被視為衡量模型效能的客觀依據,然而近期研究指出,這類評估方式存在多重局限性,其結果易受多種細節影響,對於AI研究人員和開發者而言,理解這些盲點至關重要。根據《AIInsider》報導,IBM、HuggingFace與慕尼黑工
商傳媒|葉安庭/綜合外電報導人工智慧模型的基準測試常被視為衡量模型效能的客觀依據,然而近期研究指出,這類評估方式存在多重局限性,其結果易受多種細節影響,對於AI研究人員和開發者而言,理解這些盲點至關重要。根據《AIInsider》報導,IBM、HuggingFace與慕尼黑工
商傳媒|責任編輯/綜合外電報導美國軟體公司正日益轉向使用來自中國的低成本人工智慧(AI)模型,以期降低營運開支並提升獲利能力。這一趨勢不僅改變了AI產業格局,也挑戰了過去依賴OpenAI、Google和Anthropic等美國封閉服務供應商的模式。過去幾年,隨著AI技術的快速發展,
商傳媒|林昭衡/綜合外電報導中國AI產業持續快速發展,在開源模型與半導體自主化布局同步推進下,逐漸以「夠好就好」(GoodEnough)的發展策略擴大國際影響力。外媒分析指出,中國企業透過降低開發成本、提升運算效率及推動國產設備替代,正逐步改變全球AI與半導體產業競爭模式,也讓輝達(Nvi