/v1/chat/completionsQwen3.8 Max
qwen3.8-maxQwen3.8-Max 是一款擁有2.4兆參數的MoE旗艦模型,專為進階推理、程式設計和企業生產力而設計。它能自主執行複雜的長期任務——從軟體開發到專業工作流程——在法律、金融和設計等領域提供生產級成果。憑藉原生多模態智能,Qwen3.8-Max 能理解長上下文中的文字、圖像和影片,支援對大量文件和長篇內容的深度分析。其智慧體能力支援在複雜工作流程中自主規劃、執行、驗證和持續迭代。
最大上下文
1MToken
最大輸出
128KToken
發布日期
2026年8月3日
模態
Qwen3.8 Max 價格
| 輸入價格 | 輸出價格 | 快取讀取 | 快取建立 5m | 快取讀取 5m |
|---|---|---|---|---|
| $2/M | $6/M | $0.25/M | $2.5/M | $0.17/M |
如何透過 API 使用 Qwen3.8 Max?
/v1/responses/v1/messagesQwen3.8-Max 常見問題
關於 Qwen3.8-Max 能力、使用情境、價格與 TokenHub 串接的實用解答。
Qwen3.8-Max 是什麼?+
Qwen3.8-Max 是阿里巴巴 Qwen 團隊的旗艦混合專家模型,可接收文字、圖像和影片並輸出文字;官方公布其總參數量為 2.4 兆、啟用參數為 950 億。
Qwen3.8-Max 最適合哪些情境?+
它尤其適合進階程式設計、長週期代理工作流程、複雜專業任務,以及對長文件或影片進行多模態分析。
Qwen3.8-Max 的主要優勢是什麼?+
其優勢包括 100 萬 token 上下文、可選思考模式、函式呼叫、結構化輸出、網頁搜尋和程式碼解譯等內建工具,以及原生視覺理解。
使用 Qwen3.8-Max 時應考慮哪些取捨?+
旗艦能力的成本和耗時可能高於輕量級 Qwen 模型。長時間代理執行可能累積錯誤與費用,因此應設定預算和檢查點,並審核高風險輸出。
如何在 TokenHub 使用 Qwen3.8-Max?+
在 TokenHub 的模型欄位中選擇 qwen3.8-max,再使用帳戶憑證向 TokenHub 端點傳送請求。投入正式環境前,請確認帳戶中顯示的支援參數、輸入格式與限制。
Qwen3.8-Max 如何定價和提供?+
截至 2026 年 8 月,QwenCloud 的 qwen3.8-max API 標價為每 100 萬輸入 token 2 美元、每 100 萬輸出 token 6 美元,隱式快取輸入為 0.25 美元。TokenHub 的可用性與計費可能不同,請以其即時模型頁面為準。
什麼時候應優先選擇 Qwen3.8-Max?+
當複雜程式設計、多模態推理或長週期代理任務需要 Qwen 的最高能力時,可優先選擇它。對成本敏感的工作負載可比較 qwen3.7-plus 或 qwen3.7-flash,並用代表性任務評估品質、延遲和成本。
Qwen3.8-Max 媒體與示範
精選的 Qwen3.8-Max 公開公告、示範與社群討論。
X (Twitter)
Reddit
YouTube