Alibaba
Qwen3.8 Omni Flash
最大上下文
1M
最大输出
131.1K
发布日期
暂无
qwen3.6-flashQwen3.6 Flash 是 Qwen3.6 系列中更强调速度的版本。相关来源提到它支持文本、图片和视频输入、Prompt Caching,以及 1M token 上下文窗口,这让它在快速模型里有较强的长上下文和多模态特征。它更适合高并发、多模态和长上下文任务中对速度与成本敏感的场景。
上下文窗口
1M Token
最大输出
65.5K Token
发布日期
2026年4月27日
模态
| Token 阶梯 | 输入价格 | 输出价格 | 缓存创建 5m | 缓存读取 5m |
|---|---|---|---|---|
| <=256K | $0.1714/M | $1.0286/M | $0.2143/M | $0.0171/M |
| >256K | $0.6857/M | $4.1143/M | $0.8571/M | $0.0686/M |
推理
工具调用
Temperature 参数
附件
知识库
Endpoint 协议
Qwen3.6-Flash 侧重智能体编程、数学与代码推理、空间视觉理解和长上下文处理。
在代码智能体工作负载上的能力提升,可支持迭代实现、修改和调试任务。
可推演数学和编程问题,帮助开发者形成解法并核验实现逻辑。
除文本外还可接收图像和视频,并通过增强的目标检测与定位生成基于空间信息的回答。
Qwen3.6-Flash 适合迭代式软件开发、技术问题求解以及涉及图像或视频的视觉检查任务。
在多轮代码智能体流程中生成代码、修改实现并排查缺陷。
分析数学或算法需求,提出解决思路,并将其转化为可验证的代码。
检查图像或视频帧,检测目标并确定其位置,随后生成简洁的文本报告。
运行前请替换这些路径参数: {model}
curl 'https://us-api.tokenhub.com/v1beta/models/{model}:generateContent' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"Qwen 3.6 Flash 的能力、适用场景、限制和 TokenHub 使用指南。
Qwen 3.6 Flash 是 Alibaba Qwen 面向快速多模态理解和高并发任务的模型。
适合高并发请求、图像和视频理解、对响应速度敏感的应用,尤其适合重视吞吐量的场景。
核心优势是快速的多模态响应和完整的功能组合,并具备可在深度思考和直接回答之间切换的混合思考。
它用部分峰值质量换取更好的速度或成本。 更看重最高回答质量时,可考虑 Qwen 3.7 Plus。
使用 TokenHub 显示的精确标识符,并按账户文档确认当前功能。
通过一个 API Key 接入 Qwen3.6 Flash 与更多 AI 模型。
媒体与讨论
精选与此模型相关的公开视频和帖子。
X (Twitter)
Reddit