/v1/chat/completionsDeepSeek V4 Flash Vision Exp
deepseek-v4-flash-vision-expDeepSeek V4 Flash Vision Exp 是 DeepSeek V4 Flash 0731 的实验性视觉增强版本,在保持基础模型文本性能(包括智能体能力、推理和世界知识)的同时,引入图像理解功能。它基于稀疏混合专家(MoE)架构,总参数为284B,激活参数为13B。
最大上下文
1MToken
最大输出
384KToken
发布日期
2026年8月21日
模态
DeepSeek V4 Flash Vision Exp 价格
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $0.4286/M | $1.2857/M | $0.0143/M |
如何通过 API 使用 DeepSeek V4 Flash Vision Exp?
/v1/responses/v1/messagesDeepSeek V4 Flash Vision Exp 基准测试
DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
51.8
/100
Artificial Analysis 综合能力指数
Artificial Analysis 综合能力评分
指数分数
69.1
/100
Artificial Analysis 代码能力指数
Artificial Analysis 软件任务评分
指数分数
指标来源 Artificial Analysis
DeepSeek V4 Flash Vision Exp 常见问题
在 TokenHub 评估和使用 DeepSeek V4 Flash Vision Exp 的实用指南。
deepseek-v4-flash-vision-exp 是什么?+
它是 DeepSeek 的实验性多模态模型,可接收文本和图片并输出文本。DeepSeek 将其定位为 V4 Flash 系列中支持视觉的型号。
该模型最适合哪些任务?+
它适合描述图片、读取截图文字、分析图表,以及同时需要视觉证据和语言推理的智能体工作流。
它的主要优势是什么?+
其主要优势是把 V4 Flash 的文本能力与原生图像理解结合起来。它还支持通过常见 API 形式提交图文混合请求,并可在智能体工作流中配合工具使用。
需要考虑哪些限制或取舍?+
该模型被明确标记为实验性版本,上线生产前应验证可靠性。图片会被缩放并转换为 token,可能损失细节;重要的视觉结论应由人工复核。
如何通过 TokenHub 使用该模型?+
如果你的 TokenHub 账户已提供该模型,请使用准确的模型 ID deepseek-v4-flash-vision-exp,并配合 TokenHub 接口地址和凭据调用。文本与图片应按所选 TokenHub API 路由支持的请求格式提交。
关于价格和可用性需要了解什么?+
DeepSeek 已在其 API 平台提供该实验性模型,并说明图片缩放后每张最多按 384 个 token、采用 V4 Flash 价格计费。TokenHub 的可用性和费率可能不同,部署前请查看当前模型列表。
什么时候应选择该模型而不是其他模型?+
当任务必须处理图片,并希望在同一请求中使用 V4 Flash 风格的文本与智能体能力时,可优先考虑它。对于纯文本、精细视觉或生产关键任务,应使用代表性测试与其他模型比较准确度、延迟、稳定性和成本。
DeepSeek V4 Flash Vision Exp 媒体与演示
关于 DeepSeek V4 Flash Vision Exp 的已核验公开公告、API 指南、演示和社区讨论。
X (Twitter)
Reddit
YouTube