/v1/chat/completionsQwen3.8 Max
qwen3.8-maxQwen3.8-Max 是一款拥有2.4万亿参数的MoE旗舰模型,专为高级推理、编程和企业生产力而设计。它能自主执行复杂的长期任务——从软件开发到专业工作流——在法律、金融和设计等领域提供生产级成果。凭借原生多模态智能,Qwen3.8-Max 能理解长上下文中的文本、图像和视频,支持对大量文档和长篇幅内容的深度分析。其智能体能力支持在复杂工作流中自主规划、执行、验证和持续迭代。
最大上下文
1MToken
最大输出
128KToken
发布日期
2026年8月3日
模态
Qwen3.8 Max 价格
| 输入价格 | 输出价格 | 缓存读取 | 缓存创建 5m | 缓存读取 5m |
|---|---|---|---|---|
| $2/M | $6/M | $0.25/M | $2.5/M | $0.17/M |
如何通过 API 使用 Qwen3.8 Max?
/v1/responses/v1/messagesQwen3.8-Max 常见问题
关于 Qwen3.8-Max 能力、使用场景、价格与 TokenHub 接入的实用解答。
Qwen3.8-Max 是什么?+
Qwen3.8-Max 是阿里巴巴 Qwen 团队的旗舰混合专家模型,可接收文本、图像和视频并输出文本;官方披露其总参数量为 2.4 万亿、激活参数为 950 亿。
Qwen3.8-Max 最适合哪些场景?+
它尤其适合高级编程、长周期智能体工作流、复杂专业任务,以及对长文档或视频进行多模态分析。
Qwen3.8-Max 的主要优势是什么?+
其优势包括 100 万 token 上下文、可选思考模式、函数调用、结构化输出、网页搜索和代码解释等内置工具,以及原生视觉理解。
使用 Qwen3.8-Max 时应考虑哪些取舍?+
旗舰能力的成本和耗时可能高于轻量级 Qwen 模型。长时间智能体运行可能累积错误与费用,因此应设置预算和检查点,并审核高风险输出。
如何在 TokenHub 使用 Qwen3.8-Max?+
在 TokenHub 的模型字段中选择 qwen3.8-max,再使用账户凭据向 TokenHub 接口发送请求。投入生产前,请确认账户中显示的支持参数、输入格式与限制。
Qwen3.8-Max 如何定价和提供?+
截至 2026 年 8 月,QwenCloud 的 qwen3.8-max API 标价为每 100 万输入 token 2 美元、每 100 万输出 token 6 美元,隐式缓存输入为 0.25 美元。TokenHub 的可用性与计费可能不同,请以其实时模型页面为准。
什么时候应优先选择 Qwen3.8-Max?+
当复杂编程、多模态推理或长周期智能体任务需要 Qwen 的最高能力时,可优先选择它。对成本敏感的负载可比较 qwen3.7-plus 或 qwen3.7-flash,并用代表性任务评估质量、延迟和成本。
Qwen3.8-Max 媒体与演示
精选的 Qwen3.8-Max 公开公告、演示与社区讨论。
X (Twitter)
Reddit
YouTube