POSTopenai
/v1/chat/completionsqwen3.6-flashQwen3.6 Flash 是 Qwen3.6 系列中更強調速度的版本。相关来源提到它支援文字、圖片和影片輸入、Prompt Caching,以及 1M token 上下文窗口,这让它在快速模型里有较强的長上下文和多模态特征。它更適合高并发、多模态和長上下文任務中对速度与成本敏感的場景。
最大上下文
1MToken
最大輸出
65.5KToken
發布日期
2026年4月27日
模態
| Token 階梯 | 輸入價格 | 輸出價格 | 快取建立 5m | 快取讀取 5m |
|---|---|---|---|---|
| <=256K | $0.1714/M | $1.0286/M | $0.2143/M | $0.0171/M |
| >256K | $0.6857/M | $4.1143/M | $0.8571/M | $0.0686/M |
/v1/chat/completions/v1/messages/v1beta/models/{model}:generateContentQwen 3.6 Flash 的能力、適用情境、限制與 TokenHub 使用指南。
Qwen 3.6 Flash 是 Alibaba Qwen 針對快速多模態理解與大量呼叫推出的模型。
適合大量呼叫、圖片與影片理解、重視回應速度的應用,尤其適合重視吞吐量的情境。
核心優勢是快速多模態回應與完整功能組合,並具備可在深度思考與直接回應間切換的混合思考。
它以部分峰值品質換取更好的速度或成本。 更重視最高回應品質時,可考慮 Qwen 3.7 Plus。
使用 TokenHub 顯示的精確識別碼,並依帳戶文件確認目前功能。
媒體與討論
精選與此模型相關的公開影片和貼文。
X (Twitter)
Reddit