Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max 是一款拥有2.4万亿参数的MoE旗舰模型,专为高级推理、编程和企业生产力而设计。它能自主执行复杂的长期任务——从软件开发到专业工作流——在法律、金融和设计等领域提供生产级成果。凭借原生多模态智能,Qwen3.8-Max 能理解长上下文中的文本、图像和视频,支持对大量文档和长篇幅内容的深度分析。其智能体能力支持在复杂工作流中自主规划、执行、验证和持续迭代。

最大上下文

1MToken

最大输出

128KToken

发布日期

2026年8月3日

模态

Qwen3.8 Max 价格

输入价格输出价格缓存读取缓存创建 5m缓存读取 5m
$2/M$6/M$0.25/M$2.5/M$0.17/M

如何通过 API 使用 Qwen3.8 Max?

POSTopenai/v1/chat/completions
POSTopenai-response/v1/responses
POSTanthropic/v1/messages

Qwen3.8-Max 媒体与演示

精选的 Qwen3.8-Max 公开公告、演示与社区讨论。

X (Twitter)

Open social media source
View post on X
Open social media source
View post on X
Open social media source
View post on X

Reddit

YouTube

Open social media source
Watch on YouTube
Open social media source
Watch on YouTube
Open social media source
Watch on YouTube

Qwen3.8-Max 常见问题

关于 Qwen3.8-Max 能力、使用场景、价格与 TokenHub 接入的实用解答。

Qwen3.8-Max 是什么?+

Qwen3.8-Max 是阿里巴巴 Qwen 团队的旗舰混合专家模型,可接收文本、图像和视频并输出文本;官方披露其总参数量为 2.4 万亿、激活参数为 950 亿。

Qwen3.8-Max 最适合哪些场景?+

它尤其适合高级编程、长周期智能体工作流、复杂专业任务,以及对长文档或视频进行多模态分析。

Qwen3.8-Max 的主要优势是什么?+

其优势包括 100 万 token 上下文、可选思考模式、函数调用、结构化输出、网页搜索和代码解释等内置工具,以及原生视觉理解。

使用 Qwen3.8-Max 时应考虑哪些取舍?+

旗舰能力的成本和耗时可能高于轻量级 Qwen 模型。长时间智能体运行可能累积错误与费用,因此应设置预算和检查点,并审核高风险输出。

如何在 TokenHub 使用 Qwen3.8-Max?+

在 TokenHub 的模型字段中选择 qwen3.8-max,再使用账户凭据向 TokenHub 接口发送请求。投入生产前,请确认账户中显示的支持参数、输入格式与限制。

Qwen3.8-Max 如何定价和提供?+

截至 2026 年 8 月,QwenCloud 的 qwen3.8-max API 标价为每 100 万输入 token 2 美元、每 100 万输出 token 6 美元,隐式缓存输入为 0.25 美元。TokenHub 的可用性与计费可能不同,请以其实时模型页面为准。

什么时候应优先选择 Qwen3.8-Max?+

当复杂编程、多模态推理或长周期智能体任务需要 Qwen 的最高能力时,可优先选择它。对成本敏感的负载可比较 qwen3.7-plus 或 qwen3.7-flash,并用代表性任务评估质量、延迟和成本。