Qwen

Qwen3.8-Max 正式發布並開放權重:鎖定寫程式與代理協作

2026 年 8 月 3 日,阿里巴巴正式發布 Qwen3.8-Max:百萬 token 上下文、多模態輸入、輸入每百萬 token 2 美元,並成為 Max 系列首個開放權重的模型,主打寫程式與代理協作。

Qwen3.8-Max 正式發布並開放權重:鎖定寫程式與代理協作 — 文章封面
本頁內容6 個段落
  1. 規格與定價:百萬 token 上下文
  2. 數據的但書:慢而冗長
  3. 跑分與 Cowork 框架
  4. 開放權重改變了什麼
  5. 對開發者的意義
  6. 參考來源

2026 年 8 月 3 日,阿里巴巴 Qwen 團隊正式發布 Qwen3.8-Max,公告標題把野心寫得很直白:「寫程式與 Cowork 的新標竿」(A New Bar for Coding and Cowork)。這是 7 月中旬以預覽形態現身的 Qwen3.8-Max 的正式版:當時它鎖在訂閱方案裡、權重未開,而這次發布根據官方同日訊息,Qwen3.8-Max 成為 Max 系列第一個開放權重的模型,較小的 Qwen3.8-27B 也宣布一週內跟進釋出。

社群反應熱烈:Hacker News 上的發布討論衝上 1,124 分、超過 600 則留言。在一個「新旗艦」輪番轟炸的夏天,這個熱度說明一件事——開放權重的前沿模型,仍然是開發者社群最在意的事。

規格與定價:百萬 token 上下文

綜合發布資訊與 Artificial Analysis 收錄的規格,Qwen3.8-Max 是一支推理模型,支援延伸思考,輸入接受文字、圖片與影片,上下文長度達 100 萬 token,大約相當於 1,500 頁 A4。定價落在目前旗艦市場的主流區間:輸入每百萬 token 2 美元、輸出 6 美元,快取再享 88% 折扣,混合費率約每百萬 token 1.18 美元。對讀取密集的工作流——RAG、長文件反覆問答、代理重讀上下文——這個快取折扣比帳面單價更關鍵。模型已上架 OpenRouter,第三方應用接起來沒有門檻。

數據的但書:慢而冗長

Artificial Analysis 給它 Intelligence Index 40 分,在 200 支模型中排第 30,明顯高於中位數的 24 分;評測橫跨 Terminal-Bench v4.0、SciCode、Humanity’s Last Exam 等基準,社群討論也普遍認為它的寫程式表現已經貼近 Claude 等第一梯隊。

但同一份數據有兩個但書。第一,慢:輸出速度每秒 37.9 token,遠低於中位數的 65.8。第二,冗長:整輪評測生成了約 1.8 億 token,約為中位數的兩倍。好消息是首 token 延遲 2.55 秒,優於中位數。合起來讀,這支模型的長處在「持續工作」而不是「即時對話」:適合背景任務與批次代理工作流,不適合逐字陪使用者等待的場景。

跑分與 Cowork 框架

值得注意的是評測組合本身。Terminal-Bench 考的是終端機裡的長時程操作,SciCode 考科學計算程式碼,加上代理式評測項目,這套組合明顯是為「給 agent 用的模型」設計的,而不是為聊天榜單。官方把「Cowork」放進標題,等於宣告產品定位:模型的主要客戶是代理系統與編碼工具,人機協作的長時間任務是第一場景。這也呼應了發布討論裡的觀察——多項基準已追平 Claude 等閉源對手,而開放權重是它最大的差異點。

開放權重改變了什麼

7 月的預覽被社群解讀為「旗艦鎖在訂閱牆裡」,一個多月後補開權重,等於把路線扳回 Qwen 一貫的雙軌策略:雲端 API 賺錢,開放權重搶生態。對自架推理的團隊,這是第一次能下載 Max 級權重做微調與私有部署;對 Qwen 自己,這是對 Kimi K3 等開放權重對手的直接回應。後續有兩件事值得盯:授權條款的確切內容,以及 27B 版能否延續 Qwen3.6 在本地部署累積的良好口碑。

對開發者的意義

三件事值得記下。第一,旗艦級開放權重模型又多一個選擇,定價與快取折扣對大量讀取的應用友善。第二,慢速加上高冗長輸出,代表提示詞與代理設計得更認真管 token 預算,否則帳單和延遲都會放大。第三,「Coding 與 Cowork」被寫進發布標題,確認了評測焦點正從問答轉向持續工作的能力——選模型時,長時程任務的穩定性會比單輪跑分更值得看。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

這篇內容對你有幫助嗎?

支持本站繼續整理實用的 AI 文章、教學與開發筆記。

請我喝杯咖啡
分享X電郵