in ,

阿里巴巴發佈Qwen3.8-Max新模型  佢都玩Open-weight

阿里巴巴於數小時前公布Qwen3.8-Max,宣稱是Qwen系列目前能力最強的模型,擁有2.4萬億個模型參數,規模略低於Moonshot AI上月推出的Kimi K3的2.8萬億個參數。模型現可經QwenCloud的程式介面(API)供其他軟件使用,Qwen預計下星期發布開放權重(Open-weight),讓開發者下載及自行運行模型,這將是Qwen Max級模型首次咁樣做。

Qwen3.8-Max每次回答只啟用約950億個參數。阿里巴巴稱,模型採用混合專家架構,按工作需要啟用模型內不同部分,不用每次啟用整個模型,有助減少運算成本和回應延遲。模型可處理文字、圖像和影片,單次最多處理100萬個token,即AI處理文字時使用的基本單位,讓用戶輸入長篇法律文件、大型程式碼庫或數百頁文件。

Arena.AI模型比較平台在新模型公布後,把Qwen3.8-Max列為全球第二,僅次於Claude Fable 5旗下的模型。不過,很多實際使用AI的用戶都明白,排名根本不算是最重要,很多用戶近來轉會使用OpenAI旗下的ChatGPT Work/Codex,也不一定與排名有關。

Qwen在官方文章宣稱,Qwen3.8-Max曾連續約16日編寫名為oh-my-cli的程式項目,期間毋須有人逐步指示每一個工作步驟。GitHub紀錄顯示,AI累積提交265次程式碼、127個要求合併及151項問題報告。另一次測試中,模型花約5日重造一篇研究論文的部分結果,另亦重新編寫數據處理、訓練和評估程式,寫出約7,600行程式碼,進行33輪圖形處理器(GPU)訓練。Qwen團隊稱,模型提出的改良方法在AIME24數學測試取得的分數,比原論文方法高2.7分。

記者:阿鬼

天生火爆,用一團火和光合作用,繼續盡力發聲做記者。