記者陳柏翰/台北報導
AI產品與系統評測中心(AIEC)二日公布台灣主權AI最新評測結果,雅婷智慧Yating-FedGPT-1.10.18、亞太智能機器ACE-1-24B-2604於台灣價值觀指標奪下滿分,在一百八十八個語言模型中,兩款模型總分均位於前十名。
數發部二日舉辦「主權AI評測×可信任AI行動」記者會,透過AIEC公布台灣主權AI評測結果,檢驗模型是否具備台灣語言、社會文化與價值觀等三大理解能力,並跨部會協作推動符合台灣情境的金融、法務、教育、醫療等大語言模型。
數發部長林宜敬表示,主權AI有兩個重要意義,第一,AI模型必須有台灣觀點,包括熟悉台灣語言、社會環境及具備台灣價值觀;第二,台灣必須建立算力中心,讓AI模型在台灣運行,以受到台灣法律管轄。
林宜敬指出,數發部以近五年高中學測國文科與社會科題目,透過科學方法檢驗模型的台灣語言能力及社會文化理解能力,並透過台灣社會具一定共識,評估模型對台灣價值觀的理解。
目前已有近四十家台灣業者參與驗測,其中四家業者同意公布排名。根據AIEC最新台灣主權AI評測結果,一百八十八個模型中,雅婷智慧Yating-FedGPT-1.10.18總分排名第四,亞太智能機器ACE-1-24B-2604排名第十,鴻海研究院FoxBrain v2.0則排名第十二,台灣智慧雲端Llama3.3- FFM-70B排名第四十八。
林宜敬說,在OpenAI、Anthropic、Google等國際大廠中,國內業者表現突出,「這四家廠商非常不簡單」,證明台灣具備自行訓練模型的能力,並能訓練出良好的模型。
他表示,歡迎台灣AI業者將自行開發的模型送交評測,模型評測成績會在取得業者同意後公開,相信有助於業者透過排名行銷;未來也規劃開放學校、中研院等單位參與,經由學者與專家提供題目,協助測試模型。