DeepSeek V4 Flash Vision Exp

deepseek-v4-flash-vision-exp

DeepSeek V4 Flash Vision Exp 是 DeepSeek V4 Flash 0731 的实验性视觉增强版本,在保持基础模型文本性能(包括智能体能力、推理和世界知识)的同时,引入图像理解功能。它基于稀疏混合专家(MoE)架构,总参数为284B,激活参数为13B。

最大上下文

1MToken

最大输出

384KToken

发布日期

2026年8月21日

模态

DeepSeek V4 Flash Vision Exp 价格

输入价格输出价格缓存读取
$0.4286/M$1.2857/M$0.0143/M

如何通过 API 使用 DeepSeek V4 Flash Vision Exp?

POSTopenai/v1/chat/completions
POSTopenai-response/v1/responses
POSTanthropic/v1/messages

DeepSeek V4 Flash Vision Exp 基准测试

DeepSeek V4 Flash 0731 (Reasoning, Max Effort)

51.8

/100

Artificial Analysis 综合能力指数

Artificial Analysis 综合能力评分

指数分数

69.1

/100

Artificial Analysis 代码能力指数

Artificial Analysis 软件任务评分

指数分数

指标来源 Artificial Analysis

DeepSeek V4 Flash Vision Exp 媒体与演示

关于 DeepSeek V4 Flash Vision Exp 的已核验公开公告、API 指南、演示和社区讨论。

X (Twitter)

Open social media source
View post on X
Open social media source
View post on X
Open social media source
View post on X

Reddit

YouTube

Open social media source
Watch on YouTube
Open social media source
Watch on YouTube
Open social media source
Watch on YouTube

DeepSeek V4 Flash Vision Exp 常见问题

在 TokenHub 评估和使用 DeepSeek V4 Flash Vision Exp 的实用指南。

deepseek-v4-flash-vision-exp 是什么?+

它是 DeepSeek 的实验性多模态模型,可接收文本和图片并输出文本。DeepSeek 将其定位为 V4 Flash 系列中支持视觉的型号。

该模型最适合哪些任务?+

它适合描述图片、读取截图文字、分析图表,以及同时需要视觉证据和语言推理的智能体工作流。

它的主要优势是什么?+

其主要优势是把 V4 Flash 的文本能力与原生图像理解结合起来。它还支持通过常见 API 形式提交图文混合请求,并可在智能体工作流中配合工具使用。

需要考虑哪些限制或取舍?+

该模型被明确标记为实验性版本,上线生产前应验证可靠性。图片会被缩放并转换为 token,可能损失细节;重要的视觉结论应由人工复核。

如何通过 TokenHub 使用该模型?+

如果你的 TokenHub 账户已提供该模型,请使用准确的模型 ID deepseek-v4-flash-vision-exp,并配合 TokenHub 接口地址和凭据调用。文本与图片应按所选 TokenHub API 路由支持的请求格式提交。

关于价格和可用性需要了解什么?+

DeepSeek 已在其 API 平台提供该实验性模型,并说明图片缩放后每张最多按 384 个 token、采用 V4 Flash 价格计费。TokenHub 的可用性和费率可能不同,部署前请查看当前模型列表。

什么时候应选择该模型而不是其他模型?+

当任务必须处理图片,并希望在同一请求中使用 V4 Flash 风格的文本与智能体能力时,可优先考虑它。对于纯文本、精细视觉或生产关键任务,应使用代表性测试与其他模型比较准确度、延迟、稳定性和成本。