Qwen3.5 Flash

qwen3.5-flash

Qwen3.5 Flash 是 Qwen3.5 原生视觉语言系列中的高效版本。阿里云模型列表将 Flash 定位为面向简单任务的快速、低成本选项,同时继承了 3.5 一代的多模态方向。它适合信息抽取、请求路由、轻量内容生成和高频调用。

上下文窗口

262.1K Token

最大输出

65.5K Token

发布日期

2026年2月23日

模态

Qwen3.5 Flash 价格

Token 阶梯输入价格输出价格缓存创建 5m缓存读取 5m
<=128K$0.0286/M$0.2857/M$0.0357/M$0.0029/M
128K-256K$0.1143/M$1.1429/M$0.1429/M$0.0114/M
>256K$0.1714/M$1.7143/M$0.2143/M$0.0171/M

Qwen3.5 Flash API 能力

推理

支持

工具调用

支持

Temperature 参数

支持

附件

支持

知识库

—

Endpoint 协议

Messages APIgeminiCompletions API

Qwen3.5 Flash 模型亮点

Qwen3.5 Flash 结合快速推理、原生多模态理解与长上下文处理,适合响应速度要求较高的生产任务。

高效推理

混合线性注意力与稀疏 MoE 架构旨在提供快速响应,同时兼顾通用文本和多模态任务表现。

原生多模态

模型可接收文本、图像和视频输入并生成文本,从而在一个模型中完成混合媒体理解。

百万 Token 上下文

百万 Token 上下文窗口支持分析大篇幅文档、长对话以及规模较大的混合输入集合。

Qwen3.5 Flash 使用场景

Qwen3.5 Flash 适合响应式多模态助手、快速内容处理和长上下文信息审阅。

多模态客服

结合客户提供的截图、产品图像或短视频回答问题,并生成简洁的文字指引。

内容快速分拣

对大量文本和视觉内容进行分类、摘要或关键信息提取,供后续流程审阅。

长上下文审阅

审阅大型文档集合或长对话记录,定位相关细节并生成重点摘要。

如何通过 TokenHub API 使用 Qwen3.5 Flash

创建 API key
curl 'https://us-api.tokenhub.com/v1/messages' \
  -X 'POST' \
  -H "Authorization: Bearer $TOKENHUB_API_KEY"

媒体与讨论

精选与此模型相关的公开视频和帖子。

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

Qwen 3.5 Flash 常见问题

Qwen 3.5 Flash 的能力、适用场景、限制和 TokenHub 使用指南。

Qwen 3.5 Flash 在系列中是什么角色?+

Qwen 3.5 Flash 是 Alibaba Qwen 面向快速多模态理解和高并发任务的模型。

使用 Qwen 3.5 Flash 时先试什么?+

适合高并发请求、图像和视频理解、通用对话,尤其适合重视响应速度和成本效率的场景。

为什么选择 Qwen 3.5 Flash?+

核心优势是快速多模态运行,并接近 Plus 级综合表现,并具备可在深度思考和直接回答之间切换的混合思考。

选择 Qwen 3.5 Flash 有什么取舍?+

它属于较早一代,可能缺少后续模型的新能力。 更看重需要最新能力时,可考虑 Qwen 3.6 Flash。

如何在 TokenHub 中开始使用?+

使用 TokenHub 显示的精确标识符,并按账户文档确认当前功能。

准备调用 Qwen3.5 Flash?

通过一个 API Key 接入 Qwen3.5 Flash 与更多 AI 模型。

创建 API Key