Alibaba
Qwen3.8 Omni Flash
最大上下文
1M
最大輸出
131.1K
發布日期
暫無
qwen3.6-flashQwen3.6 Flash 是 Qwen3.6 系列中更強調速度的版本。相关来源提到它支援文字、圖片和影片輸入、Prompt Caching,以及 1M token 上下文窗口,这让它在快速模型里有较强的長上下文和多模态特征。它更適合高并发、多模态和長上下文任務中对速度与成本敏感的場景。
上下文視窗
1M Token
最大輸出
65.5K Token
發布日期
2026年4月27日
模態
| Token 階梯 | 輸入價格 | 輸出價格 | 快取建立 5m | 快取讀取 5m |
|---|---|---|---|---|
| <=256K | $0.1714/M | $1.0286/M | $0.2143/M | $0.0171/M |
| >256K | $0.6857/M | $4.1143/M | $0.8571/M | $0.0686/M |
推理
工具呼叫
Temperature 參數
附件
知識庫
Endpoint 協議
Qwen3.6-Flash 著重 Agent 程式開發、數學與程式碼推理、空間視覺理解,以及長內容脈絡處理。
程式 Agent 工作負載的能力有所提升,可支援反覆實作、修改與除錯。
可推演數學與程式設計問題,協助開發者形成解法並檢查實作邏輯。
除文字外也可接收圖片與影片,並透過強化的物件偵測與定位,產生具空間依據的回應。
Qwen3.6-Flash 適合迭代式軟體開發、技術問題求解,以及涉及圖片或影片的視覺檢查工作。
在多輪程式 Agent 流程中產生程式碼、修改實作並追查缺陷。
分析數學或演算法需求、提出解題方式,並轉化為可驗證的程式碼。
檢查圖片或影片影格、偵測物件並判斷其位置,接著產生精簡的文字報告。
執行前請替換這些路徑參數: {model}
curl 'https://us-api.tokenhub.com/v1beta/models/{model}:generateContent' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"Qwen 3.6 Flash 的能力、適用情境、限制與 TokenHub 使用指南。
Qwen 3.6 Flash 是 Alibaba Qwen 針對快速多模態理解與大量呼叫推出的模型。
適合大量呼叫、圖片與影片理解、重視回應速度的應用,尤其適合重視吞吐量的情境。
核心優勢是快速多模態回應與完整功能組合,並具備可在深度思考與直接回應間切換的混合思考。
它以部分峰值品質換取更好的速度或成本。 更重視最高回應品質時,可考慮 Qwen 3.7 Plus。
使用 TokenHub 顯示的精確識別碼,並依帳戶文件確認目前功能。
透過一個 API Key 接入 Qwen3.6 Flash 與更多 AI 模型。
媒體與討論
精選與此模型相關的公開影片和貼文。
X (Twitter)
Reddit