發表文章

目前顯示的是有「Qwen3.8-Max」標籤的文章

Qwen3.8-Max評測:阿里2.4兆參數模型下週開源 | Qwen3.8-Max Review: Alibaba 2.4T Model Goes Open Source

By Kit 小克 | AI Tool Observer | 2026-08-05 🇹🇼 Qwen3.8-Max評測:阿里2.4兆參數模型下週開源 Qwen3.8-Max 是阿里巴巴8月4日發布的最新旗艦模型,總參數量達2.4兆、採用MoE(混合專家)架構、每次請求僅啟動約950億參數,支援高達100萬token的上下文視窗。這次發布最受矚目的不是效能數字,而是阿里承諾 下週釋出開源權重 ——這是Qwen-Max等級模型首次不再只鎖在API後面。 Qwen3.8-Max效能到底如何? 基準測試結果是「各有勝負」,不是一面倒的碾壓。在程式碼相關測試上: Terminal-Bench 2.1 :86.6分,略輸GPT-5.6 Sol的88.8分,但贏過Claude Opus 4.8與Fable 5的84.6分 SWE-bench Pro :67.7分,明顯落後Claude Fable 5的80.0分,這是Qwen3.8-Max最弱的一塊 PaperBench :93.0分,反而超越GPT-5.6 Sol的90.5分與Fable 5的88.8分 在代理(Agent)任務與長流程作業上,Qwen3.8-Max表現最亮眼:CoWorkBench拿下74.8分(贏過Sol的71.5分),WideSearch更是拿到81.9分。官方展示案例包括讓模型獨立完成125小時的研究複現任務、10天份的完整程式專案,以及一場電商模擬賺進人民幣416,252元——顯示這顆模型的長時間自主作業能力是重點賣點,而非單純的解題分數。 為什麼開源這件事比跑分更重要 過去阿里的Qwen-Max系列都是「參數最大、效能最強」但只能透過API使用的頂規模型,開源的是縮小版。這次Qwen3.8-Max打算把旗艦權重也公開,加上小老弟Qwen3.8-27B同步開源,等於讓企業和開發者可以自架、微調、甚至商用部署一顆真正接近前沿水準的模型,不必被單一API供應商綁住。這對正在評估 私有化部署 或資料合規要求高的團隊,是很實際的誘因。 價格與取得方式 API目前已經上線,走OpenAI相容端點,價格為每百萬輸入token 2美元、每百萬輸出token 6美元,快取輸入token只要0.25美元,比多數西方競品便宜不少。內建五種工具(程式碼直譯器、網頁搜尋、網頁...