Alibaba
Qwen3.8 Omni Flash
最大上下文
1M
最大輸出
131.1K
發布日期
暫無
qwen3.5-flashQwen3.5 Flash 是 Qwen3.5 原生視覺语言系列中的高效版本。阿里云模型列表将 Flash 定位为面向简单任務的快速、低成本选项,同时继承了 3.5 一代的多模态方向。它適合信息擷取、請求路由、輕量内容生成和高頻調用。
上下文視窗
262.1K Token
最大輸出
65.5K Token
發布日期
2026年2月23日
模態
| Token 階梯 | 輸入價格 | 輸出價格 | 快取建立 5m | 快取讀取 5m |
|---|---|---|---|---|
| <=128K | $0.0286/M | $0.2857/M | $0.0357/M | $0.0029/M |
| 128K-256K | $0.1143/M | $1.1429/M | $0.1429/M | $0.0114/M |
| >256K | $0.1714/M | $1.7143/M | $0.2143/M | $0.0171/M |
推理
工具呼叫
Temperature 參數
附件
知識庫
Endpoint 協議
Qwen3.5 Flash 結合快速推論、原生多模態理解與長內容脈絡處理,適合重視回應速度的正式工作負載。
混合線性注意力與稀疏 MoE 架構著重快速回應,同時兼顧一般文字與多模態工作的表現。
模型可接收文字、影像與影片輸入並產生文字,能以單一模型理解混合媒體內容。
百萬 Token 的內容脈絡視窗可用於分析大型文件、長對話與大量混合輸入內容。
Qwen3.5 Flash 適合回應快速的多模態助理、內容快速處理與長內容脈絡資訊審閱。
依據客戶提供的螢幕截圖、產品影像或短片回答問題,並產生精簡的文字指引。
針對大量文字與視覺內容進行分類、摘要或重點資料擷取,供後續流程審閱。
審閱大型文件集合或長篇對話紀錄,找出相關細節並產出重點摘要。
執行前請替換這些路徑參數: {model}
curl 'https://us-api.tokenhub.com/v1beta/models/{model}:generateContent' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"Qwen 3.5 Flash 的能力、適用情境、限制與 TokenHub 使用指南。
Qwen 3.5 Flash 是 Alibaba Qwen 針對快速多模態理解與大量呼叫推出的模型。
適合大量呼叫、圖片與影片理解、一般對話,尤其適合重視回應速度與成本效益的情境。
核心優勢是快速多模態運作,整體表現接近 Plus 等級,並具備可在深度思考與直接回應間切換的混合思考。
它屬於較早世代,可能缺少後續模型的新能力。 更重視需要最新能力時,可考慮 Qwen 3.6 Flash。
使用 TokenHub 顯示的精確識別碼,並依帳戶文件確認目前功能。
透過一個 API Key 接入 Qwen3.5 Flash 與更多 AI 模型。
媒體與討論
精選與此模型相關的公開影片和貼文。
X (Twitter)
Reddit
YouTube