适合选择 DeepSeek V4 Pro 的情况
- TokenHub 最高推理档位的 Intelligence Index 为 44.3、Coding Index 为 47.5
- 输入 $1.80/M、输出 $3.50/M
- 1M 上下文与 384K 最大输出,适合纯文本长内容任务
本页将 DeepSeek 的 DeepSeek V4 Pro 与 DeepSeek 的 DeepSeek V4 Flash 并排展示,便于查看价格、模型 ID、上下文与输出上限、模态、工具调用、发布日期以及可用的基准测试表现。
综合建议
DeepSeek V4 Pro 的 TokenHub Intelligence 与 Coding Index 更高,同时保留相同的 1M 上下文和 384K 输出,是能力默认项;若更看重约低 12 倍的输入成本和低 11.7 倍的输出成本,则选择 Flash。
名称
模型 ID
数据来源
简介
供应商
发布日期
上下文长度
最大输出 Token
名称
模型 ID
数据来源
简介
供应商
发布日期
上下文长度
最大输出 Token
名称
名称
模型 ID
模型 ID
数据来源
数据来源
简介
简介
供应商
供应商
发布日期
发布日期
上下文长度
上下文长度
最大输出 Token
最大输出 Token
输入
输出
缓存输入
输入
输出
缓存输入
输入
输入
输出
输出
缓存输入
缓存输入
推理
知识
附件
输入模态
输出模态
温度参数
工具调用
推理
知识
附件
输入模态
输出模态
温度参数
工具调用
推理
推理
知识
知识
附件
附件
输入模态
输入模态
输出模态
输出模态
温度参数
温度参数
工具调用
工具调用
综合能力
代码能力
综合能力
代码能力
GPQA
HLE
GPQA
HLE
SciCode
Terminal-Bench Hard
SciCode
Terminal-Bench Hard
IFBench
AA-LCR
Tau2
IFBench
AA-LCR
Tau2
没有绝对“更好”的模型。先看上方“模型选择指南”中与任务对应的建议,再用价格、上下文长度、最大输出和能力项确认是否满足你的实际调用需求。
可以查看上方价格区,对比 DeepSeek V4 Pro 与 DeepSeek V4 Flash 的输入、输出和缓存输入价格。
DeepSeek V4 Pro 的上下文长度为 1M,DeepSeek V4 Flash 的上下文长度为 1M。
如果两个模型都在 TokenHub 模型目录中可用,就可以通过 TokenHub API 路由到 DeepSeek V4 Pro 和 DeepSeek V4 Flash。
不必只在这两个模型之间选择。浏览模型广场,按能力、上下文和价格继续筛选,找到更适合你工作负载的模型。