MoneyDJ新聞 2026-08-13 10:58:49 新聞中心 發佈
綜合陸媒報導,阿里巴巴(BABA.US;9988.HK)旗下通義千問(Qwen)團隊正式開放Qwen3.8-2.4T-A95B模型權重。此次是Qwen-Max級別的模型首次開源權重,該模型總參數為2.4T,每個Token啟動95B參數,原生支持262,144 Token上下文,並可擴展至1,010,000 Token。官方表示,Qwen3.8延續Qwen3.5的混合架構,重點提升編程、辦公、科研和長週期Agent任務的端到端完成能力。
官方公布的評測覆蓋編程Agent、通用Agent、專業工作和長上下文等方向;與Opus 4.8、Fable 5、GPT 5.6 Sol等模型相比,各項結果互有高低,並在PaperBench、IFBench等Benchmark中取得所列模型中的較高成績。據悉,Qwen3.8-2.4T-A95B是一個因果語言模型,總參數為2.4T,每個Token啟動95B。模型每個MoE層包含512個專家,每個Token選擇10個路由專家,並同時啟動1個共享專家。
同時,模型還進行了多步MTP(Multi-Token Prediction)訓練,為支持相應機制的推理引擎提供預測多個後續Token的能力。此外,Qwen3.8-2.4T-A95B模型可以透過SGLang、vLLM和TokenSpeed推理引擎部署,正式部署時需要使用各框架針對Qwen3.8的最新Recipe,並根據權重精度、GPU型號與數量選擇並行策略。開源AI項目團隊Unsloth AI靠動態1‑bit分層選擇性量化技術,將Qwen3.8‑2.4T‑A95B原始4.9TB的模型體積壓縮至397GB,記憶體空間縮減91%。