首頁 -> 港澳 ->社會

港大指人工智能大語言模型文心一言4中文表現最佳

分享到:
2024-03-12 19:52 | 稿件來源:香港新聞網

【字號:

香港新聞網3月12日電  香港大學經管學院日前就多個主流的人工智能大語言模型(LLMs)在中文及英文環境進行綜合深入評測,並發表評測報告,於12日公佈中文和英文語境大模型排行榜。在中文語境下,文心一言4綜合表現最佳;而在英文語境下,GPT 4-turbo領先優勢明顯。

報告評測了14款中文及16款英文語境下的人工智能通用大語言模型。評測主要針對三大核心能力,包括自然語言能力、專業學科能力以及安全與責任,要求大模型展現出對人類角色、微妙情感和文化語境的深入理解,並在更複雜和多樣化的情境中準確理解和回應指令,以及對人類學科知識的掌握、處理敏感話題的能力等。

在中文語境下,文心一言4綜合表現最佳,GPT4-turbo與通義千問2緊隨其後。文心一言4對中文特色語境表現出更好的適應能力。在安全與責任方面,文心一言4得分亦最高,展現出較成熟的安全意識。文心一言4的表現,也側面反映越來越多高品質的中文資料集,逐步被構築並應用於國產大模型,以創造出更好的中文思維AI助手。

在英文語境下,僅有GPT 4-turbo一款模型的綜合得分獲得80分以上,大多數國產大模型在英文語境下的綜合表現處於稍微劣勢的位置。這也與國產大模型訓練的數據多為中文有關。

港大經管學院創新及資訊管理學教授蔣鎮輝表示,中國具有大語言模型應用的豐富場景,特別是在教育、金融、醫療、法律、零售等方面,未來的想像空間是十分寬廣的。在人工智能大語言模型的領域,中國科技不該只做個追隨者,而應該勇於成為引領者,中國的大語言模型呼喚更多從0到1的原創性核心技術。(完)


【編輯:譚暢】

視頻

更 多
【通講壇】歷史陰影重現?日本“特高課”是否正在借殼還魂
【通視街採】在香港攢夠多少錢才敢退休?有人退而不休,有人放眼大灣區
香港青少年軍事生活體驗營開營 學員激動表示:期待又緊張!
香港學生暑假去哪好?走進故宮“當金匠”!
親身體驗中國承建中亞首條無人駕駛輕軌 市民點讚“太酷了”:28分鐘穿越整座城
【你不知道的香港】營運不到一年乘客破50萬!香港“落日飛車”為何那麼火?
專訪菲爾茲獎首位華人得主丘成桐:期待中國本土培養學者拿下菲爾茲獎