Alibaba
Qwen3.8 Omni Flash
最大上下文
1M
最大输出
131.1K
发布日期
暂无
qwen3.5-flashQwen3.5 Flash 是 Qwen3.5 原生视觉语言系列中的高效版本。阿里云模型列表将 Flash 定位为面向简单任务的快速、低成本选项,同时继承了 3.5 一代的多模态方向。它适合信息抽取、请求路由、轻量内容生成和高频调用。
上下文窗口
262.1K Token
最大输出
65.5K Token
发布日期
2026年2月23日
模态
| Token 阶梯 | 输入价格 | 输出价格 | 缓存创建 5m | 缓存读取 5m |
|---|---|---|---|---|
| <=128K | $0.0286/M | $0.2857/M | $0.0357/M | $0.0029/M |
| 128K-256K | $0.1143/M | $1.1429/M | $0.1429/M | $0.0114/M |
| >256K | $0.1714/M | $1.7143/M | $0.2143/M | $0.0171/M |
推理
工具调用
Temperature 参数
附件
知识库
Endpoint 协议
Qwen3.5 Flash 结合快速推理、原生多模态理解与长上下文处理,适合响应速度要求较高的生产任务。
混合线性注意力与稀疏 MoE 架构旨在提供快速响应,同时兼顾通用文本和多模态任务表现。
模型可接收文本、图像和视频输入并生成文本,从而在一个模型中完成混合媒体理解。
百万 Token 上下文窗口支持分析大篇幅文档、长对话以及规模较大的混合输入集合。
Qwen3.5 Flash 适合响应式多模态助手、快速内容处理和长上下文信息审阅。
结合客户提供的截图、产品图像或短视频回答问题,并生成简洁的文字指引。
对大量文本和视觉内容进行分类、摘要或关键信息提取,供后续流程审阅。
审阅大型文档集合或长对话记录,定位相关细节并生成重点摘要。
curl 'https://us-api.tokenhub.com/v1/messages' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"Qwen 3.5 Flash 的能力、适用场景、限制和 TokenHub 使用指南。
Qwen 3.5 Flash 是 Alibaba Qwen 面向快速多模态理解和高并发任务的模型。
适合高并发请求、图像和视频理解、通用对话,尤其适合重视响应速度和成本效率的场景。
核心优势是快速多模态运行,并接近 Plus 级综合表现,并具备可在深度思考和直接回答之间切换的混合思考。
它属于较早一代,可能缺少后续模型的新能力。 更看重需要最新能力时,可考虑 Qwen 3.6 Flash。
使用 TokenHub 显示的精确标识符,并按账户文档确认当前功能。
通过一个 API Key 接入 Qwen3.5 Flash 与更多 AI 模型。
媒体与讨论
精选与此模型相关的公开视频和帖子。
X (Twitter)
Reddit
YouTube