請輸入關鍵字:

熱門搜尋:

阿裡巴巴推出更高效的Qwen3-Next人工智能模型

日期: 2025年9月12日 上午7:27

PANews 9月12日消息,阿裡巴巴旗下通義千問發佈了下一代基礎模型架構Qwen3-Next,並開源了基於該架構的Qwen3-Next-80B-A3B係列模型。該結構相比Qwen3的MoE模型結構,進行了以下核心改進:混合注意力機制、高稀疏度MoE結構、一係列訓練穩定友好的優化,以及提升推理效率的多token預測機制。基於Qwen3-Next的模型結構,阿裡訓練了Qwen3-Next-80B-A3B-Base模型,該模型擁有800億參數僅激活30億參數。該Base模型實現了與Qwen3-32B dense模型相近甚至略好的性能,而它的訓練成本(GPU hours) 僅為Qwen3-32B的十分之一不到,在32k以上的上下文下的推理吞吐則是Qwen3-32B的十倍以上,實現了極致的訓練和推理性價比。

内容來源:PANews

財華網所刊載內容之知識產權為財華網及相關權利人專屬所有或持有。未經許可,禁止進行轉載、摘編、複製及建立鏡像等任何使用。

如有意願轉載,請發郵件至 content@finet.com.hk,獲得書面確認及授權後,方可轉載。

下載APP 下載財華財經APP,把握投資先機
更多精彩内容,請點擊: 財華網(https://www.finet.hk/) 財華智庫網(https://www.finet.com.cn) 現代電視FINTV(http://www.fintv.hk)

視頻

快訊

14:53
大昌微線集團(00567.HK)​主要股東向金安智能轉讓約17.36%股份
14:42
中國碳中和(01372.HK)與陝西理谷新能源簽署戰略合作協議
14:32
日韓股市雙雙收漲
14:23
長和旗下巴拿馬港口公司:正式對馬士基啟動仲裁程序
14:11
山東新華製藥股份(00719.HK)獲得鈉鉀鎂鈣注射用濃溶液藥品註冊證書
14:00
光大證券(06178.HK):王翠婷辭任高級專家職務
13:53
東岳集團(00189.HK)漲超8% 東岳硅材料首季淨利潤同比增397.02%至451.34%
13:45
【異動股】黃金板塊拉升,曉程科技(300139.CN)漲17.4%
13:41
榮尊國際控股(01780.HK)短暫停牌
13:30
【異動股】港股跌幅榜前十,恒益控股(01894.HK)跌63.39%,XI二南三星(07347.HK)跌37.78%