首頁 -> 內地
DeepSeek發布最新大語言模型 關聯下一代中國芯片分享到:
香港中通社8月21日電 中國人工智能(AI)公司深度求索(DeepSeek)21日宣布,其最新大語言模型DeepSeek-V3.1正式發布。
香港中通社資料圖 據DeepSeek介紹,新升級版本的變化主要體現在三個方面:混合推理架構、更高的思考效率、更強的Agent(智能體)能力。 DeepSeek-V3.1實現了一個模型同時支持思考模式與非思考模式。它就像一個擁有兩種工作模式的超級大腦,當面對簡單問題時,能以非思考模式快速給出答案。而在處理複雜問題時,可切換到思考模式,給出更具深度和邏輯的解答。用戶可通過官方App或網頁端的“深度思考”按鈕切換這兩種模式。 此外,DeepSeek-V3.1使用了UE8M0 FP8 Scale的參數精度。當天,DeepSeek官方公眾號在其文章置頂留言裡說,UE8M0 FP8是針對即將發布的下一代中國產芯片設計。 官方數據顯示,與DeepSeek-R1-0528相比,DeepSeek-V3.1在思考模式下效率大幅提升,能在更短時間內給出答案,且經過思維鏈壓縮訓練,token(大模型文本處理的最小單位)消耗量可減少20%至50%,各項任務的平均表現與R1-0528持平。R1-0528是DeepSeek於今年5月發布的旗艦推理模型DeepSeek R1的升級版本。(完) 【編輯:石歡歡】
相關新聞 |
視頻更 多
【通講壇】歷史陰影重現?日本“特高課”是否正在借殼還魂
【通視街採】在香港攢夠多少錢才敢退休?有人退而不休,有人放眼大灣區
香港青少年軍事生活體驗營開營 學員激動表示:期待又緊張!
香港學生暑假去哪好?走進故宮“當金匠”!
親身體驗中國承建中亞首條無人駕駛輕軌 市民點讚“太酷了”:28分鐘穿越整座城
【你不知道的香港】營運不到一年乘客破50萬!香港“落日飛車”為何那麼火?
專訪菲爾茲獎首位華人得主丘成桐:期待中國本土培養學者拿下菲爾茲獎
來論更 多評論更 多
論壇更 多閱讀排行
|










