AIEC評測 雅婷智慧、亞太智能機器模型台灣價值觀滿分
AIEC評測 雅婷智慧、亞太智能機器模型台灣價值觀滿分
https://www.cna.com.tw/news/afe/202609020138.a…
中央社
記者趙敏雅
AI產品與系統評測中心(AIEC)公布台灣主權AI最新評測結果,雅婷智慧Yating-FedGPT-1. 10.18、亞太智能機器ACE-1-24B-2604於台灣價值觀指標奪下滿分,在188個語言模型中,兩款模型總分均位於前10名。
數發部今天舉辦「主權AI評測×可信任AI行動」記者會,透過AIEC公布台灣主權AI評測結果,檢驗模型是否具備台灣語言、社會文化與價值觀等3大理解能力,並跨部會協作推動符合台灣情境的金融、法務、教育、醫療等大語言模型。
數發部長林宜敬表示,主權AI有兩個重要意義,第一,AI模型必須有台灣觀點,包括熟悉台灣語言、社會環境及具備台灣價值觀;第二,台灣必須建立算力中心,讓AI模型在台灣運行,以受到台灣法律管轄。
林宜敬進一步說,數發部以近5年高中學測國文科與社會科題目,透過科學方法檢驗模型的台灣語言能力及社會文化理解能力,並透過台灣社會具一定共識,評估模型對台灣價值觀的理解。
目前已有近40家台灣業者參與驗測,其中4家業者同意公布排名。根據AIEC最新台灣主權AI評測結果,188個模型中,雅婷智慧Yating-FedGPT-1.10.18總分排名第4,亞太智能機器ACE-1-24B-2604排名第10,鴻海研究院FoxBrain v2.0則排名第12,台灣智慧雲端Llama3.3- FF M-70B排名第48。
林宜敬指出,在OpenAI、Anthropic、Google等國際大廠中,國內業者表現突出,「這4家廠商非常不簡單」,證明台灣具備自行訓練模型的能力,並能訓練出良好的模型。
林宜敬表示,歡迎台灣AI業者將自行開發的模型送交評測,模型評測成績會在取得業者同意後公開,相信有助於業者透過排名行銷;未來也規劃開放學校、中研院等單位參與,經由學者與專家提供題目,協助測試模型。
數產署長林俊秀談及,台灣AI業者將模型送交評測後,數發部也會提供相關輔導。目前業者申請評測免費,相關經費已持續編列。
雅婷智慧、亞太智能機器、鴻海研究院及長聯科技等產業代表也出席,會中分享送測經驗與應用成果。業者認為,透過第三方評測,可掌握產品優勢與精進方向,使用端也能依據實際場域選擇合適的模型。
數產署表示,將持續擴大國內AI評測夥伴生態系,並串聯硬體、資安、資料治理、模型訓練等產業能量,透過評測建立信任、以信任帶動產品發展,將台灣累積的AI評測及解決方案經驗推向國際。
--