DeepSeek V4 Pro vs DeepSeek V4 Flash

本页将 DeepSeek 的 DeepSeek V4 Pro 与 DeepSeek 的 DeepSeek V4 Flash 并排展示,便于查看价格、模型 ID、上下文与输出上限、模态、工具调用、发布日期以及可用的基准测试表现。

综合建议

DeepSeek V4 Pro 的 TokenHub Intelligence 与 Coding Index 更高,同时保留相同的 1M 上下文和 384K 输出,是能力默认项;若更看重约低 12 倍的输入成本和低 11.7 倍的输出成本,则选择 Flash。

综合建议基于 DeepSeek V4 Pro (Reasoning, Max Effort) 与 DeepSeek V4 Flash (Reasoning, Max Effort) 档位。

对比亮点

DeepSeek V4 ProDeepSeek
DeepSeek V4 FlashDeepSeek
最适合
长上下文推理代码库分析成本控制
高吞吐成本敏感的长上下文任务
如何理解根据模型能力与产品定位综合判断。
任务定位
推理编程长上下文
吞吐低成本长上下文
如何理解模型最直接面向的工作负载。
输入
$1.2857/M
$0.4286/M优势
如何理解提示词或检索内容较大时,价格越低越好。
输出
$3.8571/M
$1.2857/M优势
如何理解推理密集或长文本生成场景中,价格越低越好。
上下文长度
1M
1M
如何理解处理代码仓库、检索资料与长转录时,容量越大越好。
输入模态
文本
文本
如何理解输入类型越丰富,越不需要额外接入视觉或视频模型。

模型选择指南

DeepSeek V4 ProDeepSeek

适合选择 DeepSeek V4 Pro 的情况

  • TokenHub 最高推理档位的 Intelligence Index 为 44.3、Coding Index 为 47.5
  • 输入 $1.80/M、输出 $3.50/M
  • 1M 上下文与 384K 最大输出,适合纯文本长内容任务
DeepSeek V4 FlashDeepSeek

适合选择 DeepSeek V4 Flash 的情况

  • 价格最低:输入 $0.15/M、输出 $0.30/M
  • TokenHub 最高推理档位的 Intelligence Index 为 40.3、Coding Index 为 38.7
  • 1M 上下文与 384K 最大输出,适合高吞吐纯文本任务

基础信息

DeepSeek V4 ProDeepSeek
DeepSeek V4 FlashDeepSeek

名称

DeepSeek V4 ProDeepSeek V4 Pro

模型 ID

DeepSeek V4 Prodeepseek-v4-pro

简介

DeepSeek V4 ProDeepSeek V4 Pro 被描述为大规模 MoE 模型,拥有 1.6T 总参数与 49B 激活参数,并支持 1M token 上下文窗口,适合处理超长输入。官方和三方模型卡更强调它在高级推理、代码任务和长周期 Agent 工作流中的能力,而不是普通聊天。相比 V4 Flash,Pro 更偏能力上限,适合大型代码库分析、复杂研究资料综合、多步骤自动化等需要深度推理的任务。

供应商

DeepSeek V4 ProDeepSeek

发布日期

DeepSeek V4 Pro2026-04-24

上下文长度

DeepSeek V4 Pro1M

最大输出 Token

DeepSeek V4 Pro384K

名称

DeepSeek V4 FlashDeepSeek V4 Flash

模型 ID

DeepSeek V4 Flashdeepseek-v4-flash

简介

DeepSeek V4 FlashDeepSeek V4 Flash 保留了 V4 系列的 1M token 长上下文能力,但采用更轻量的 MoE 配置,常见模型卡描述为 284B 总参数、13B 激活参数。它的重点不是最大推理深度,而是更快推理、更低调用成本和更适合生产环境的吞吐量。对于高频请求、批量处理和长上下文但不一定需要最高推理强度的任务,Flash 会比 Pro 更合适。

供应商

DeepSeek V4 FlashDeepSeek

发布日期

DeepSeek V4 Flash2026-04-24

上下文长度

DeepSeek V4 Flash1M

最大输出 Token

DeepSeek V4 Flash384K

价格

DeepSeek V4 ProDeepSeek
DeepSeek V4 FlashDeepSeek

输入

DeepSeek V4 Pro$1.2857/M

输出

DeepSeek V4 Pro$3.8571/M

缓存输入

DeepSeek V4 Pro$0.0429/M

输入

DeepSeek V4 Flash$0.4286/M

输出

DeepSeek V4 Flash$1.2857/M

缓存输入

DeepSeek V4 Flash$0.0143/M

能力特性

DeepSeek V4 ProDeepSeek
DeepSeek V4 FlashDeepSeek

推理

DeepSeek V4 Pro

知识

DeepSeek V4 Pro2025-05-01

附件

DeepSeek V4 Pro

输入模态

DeepSeek V4 Pro文本

输出模态

DeepSeek V4 Pro文本

温度参数

DeepSeek V4 Pro

工具调用

DeepSeek V4 Pro

推理

DeepSeek V4 Flash

知识

DeepSeek V4 Flash2025-05-01

附件

DeepSeek V4 Flash

输入模态

DeepSeek V4 Flash文本

输出模态

DeepSeek V4 Flash文本

温度参数

DeepSeek V4 Flash

工具调用

DeepSeek V4 Flash

基准测试

DeepSeek V4 ProDeepSeek
DeepSeek V4 FlashDeepSeek

综合能力

领先44.3

代码能力

领先47.5

综合能力

40.3

代码能力

38.7

知识与推理

GPQA

88.8%

HLE

领先35.9%

GPQA

领先89.4%

HLE

32.1%

代码能力

SciCode

领先50%

Terminal-Bench Hard

领先46.2%

SciCode

44.9%

Terminal-Bench Hard

35.6%

指令遵循与 Agent 任务

IFBench

76.5%

AA-LCR

领先66.3%

Tau2

领先96.2%

IFBench

领先79.2%

AA-LCR

63%

Tau2

95.0%

常见问题

DeepSeek V4 Pro 和 DeepSeek V4 Flash 哪个更好?

+

应根据具体工作负载选择。本文把 DeepSeek V4 Pro 与 DeepSeek V4 Flash 的价格、上下文、输出上限、能力和基准测试数据并排展示。

DeepSeek V4 Flash 比 DeepSeek V4 Pro 更便宜吗?

+

可以查看上方价格区,对比 DeepSeek V4 Pro 与 DeepSeek V4 Flash 的输入、输出和缓存输入价格。

哪个模型支持更长上下文?

+

DeepSeek V4 Pro 的上下文长度为 1M,DeepSeek V4 Flash 的上下文长度为 1M。

两个模型都能通过 TokenHub 使用吗?

+

如果两个模型都在 TokenHub 模型目录中可用,就可以通过 TokenHub API 路由到 DeepSeek V4 Pro 和 DeepSeek V4 Flash。