請輸入關鍵字:

熱門搜尋:

阿裡巴巴推出更高效的Qwen3-Next人工智能模型

 
日期: 2025年9月12日 上午7:27

PANews 9月12日消息,阿裡巴巴旗下通義千問發佈了下一代基礎模型架構Qwen3-Next,並開源了基於該架構的Qwen3-Next-80B-A3B係列模型。該結構相比Qwen3的MoE模型結構,進行了以下核心改進:混合注意力機制、高稀疏度MoE結構、一係列訓練穩定友好的優化,以及提升推理效率的多token預測機制。基於Qwen3-Next的模型結構,阿裡訓練了Qwen3-Next-80B-A3B-Base模型,該模型擁有800億參數僅激活30億參數。該Base模型實現了與Qwen3-32B dense模型相近甚至略好的性能,而它的訓練成本(GPU hours) 僅為Qwen3-32B的十分之一不到,在32k以上的上下文下的推理吞吐則是Qwen3-32B的十倍以上,實現了極致的訓練和推理性價比。

内容來源:PANews

財華網所刊載內容之知識產權為財華網及相關權利人專屬所有或持有。未經許可,禁止進行轉載、摘編、複製及建立鏡像等任何使用。

如有意願轉載,請發郵件至 content@finet.com.hk,獲得書面確認及授權後,方可轉載。

下載APP 下載財華財經APP,把握投資先機
更多精彩内容,請點擊: 財華網(https://www.finet.hk/) 財華智庫網(https://www.finet.com.cn) 現代電視FINTV(http://www.fintv.hk)

PANews

PANews是區塊鏈和Web3.0領域領先的智庫型信息平台,為行業用戶提供具有國際視野的前沿資訊與報告。PANews優質多元的内容以圖文、音頻、視頻等形式在全網多渠道覆蓋,包含推特、微博、抖音、視頻號等主流平台,旨在成為用戶的Web3信息官。PANews同時還是騰訊新聞的内容合作夥伴,内容被福佈斯、財新等媒體引用,獲得騰訊新聞、今日頭條、澎湃新聞等頒發的相關獎項。PANews的兩位聯合創始人均為福

視頻

快訊

17:34
宏安地產(01243.HK)年度合約銷售總額約28.41億港元​
17:28
藍佛安會見埃塞俄比亞財政部部長希德
17:18
中國利郎(01234.HK)第一季度「LILANZ」產品零售金額同比錄得低雙位數增長
17:11
百奧家庭互動(02100.HK)獲董事會主席戴堅增持7萬股
17:01
保利置業集團(00119.HK)3月合同銷售金額約52億元
16:51
維立志博-B(09887.HK)維利信治療膽道癌II期研究順利進入擴展階段
16:47
瀚源控股(00439.HK):黃繼傑及李釗浩辭任非執行董事
16:34
寶龍地產(01238.HK)3月合約銷售額6.49億元
16:20
【異動股】港股跌幅榜前十,恒益控股(01894.HK)跌68.87%,XI二南三星(07347.HK)跌37.14%
16:20
【異動股】港股漲幅榜前十,意力國際(00585.HK)漲92.63%,環球戰略集團(08007.HK)漲81.13%