AI 評測標準恐不準確 史丹佛大學指現行方法存隱憂
商傳媒|林昭衡/綜合外電報導根據史丹佛大學(Stanford)研究人員近期的一項研究,目前用來評估人工智慧(AI)模型表現的評測標準(benchmarks)可能存在根本性缺陷,導致其結果並不完全準確。這些評測標準在決定AI模型的市場價值、政策制定及政府採購上扮演關鍵角色,然而其可靠性正受
商傳媒|林昭衡/綜合外電報導根據史丹佛大學(Stanford)研究人員近期的一項研究,目前用來評估人工智慧(AI)模型表現的評測標準(benchmarks)可能存在根本性缺陷,導致其結果並不完全準確。這些評測標準在決定AI模型的市場價值、政策制定及政府採購上扮演關鍵角色,然而其可靠性正受
(觀傳媒大台北新聞)【記者蔡宇辰/台北報導】AI會說繁體中文,不代表真正懂臺灣!數位發展部2日舉辦「主權AI評測×可信任AI行動」記者會,透過AI產品與系統評測中心(AIEC)公布臺灣主權AI評測結果,檢驗模型是否具備臺灣語言、社會文化與價值觀等3大理解能力,並跨部會協作推