DeepSeek
DeepSeek V4.1 Flash
最大上下文
1M
最大输出
384K
发布日期
暂无
deepseek-v4-proDeepSeek V4 Pro 被描述为大规模 MoE 模型,拥有 1.6T 总参数与 49B 激活参数,并支持 1M token 上下文窗口,适合处理超长输入。官方和三方模型卡更强调它在高级推理、代码任务和长周期 Agent 工作流中的能力,而不是普通聊天。相比 V4 Flash,Pro 更偏能力上限,适合大型代码库分析、复杂研究资料综合、多步骤自动化等需要深度推理的任务。
上下文窗口
1M Token
最大输出
384K Token
发布日期
2026年4月24日
模态
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $1.2857/M | $3.8571/M | $0.0429/M |
推理
工具调用
Temperature 参数
附件
知识库
Endpoint 协议
DeepSeek V4 Pro 面向长上下文推理、Agent 工作流与复杂软件工程任务的核心优势。
正式版增强了自主规划、工具使用和多步骤任务完成能力,适合构建复杂的 Agent 工作流。
经过评测的代码库理解与软件工程能力,可支持跨多个文件分析并实施协同修改。
一百万 token 的上下文窗口,可在同一上下文中处理大量代码、文档和任务历史。
提供 low、high 和 max 三档推理级别,开发者可按任务复杂度调整思考深度。
官方模型权重采用 MIT 许可证发布,开发者可以在自有或受控基础设施中运行和适配模型。
适合使用 DeepSeek V4 Pro 完成代码库维护、终端工程、工具驱动自动化与长上下文分析的典型工作负载。
分析代码库中的依赖关系,定位受影响文件,并针对已报告的软件问题实施协同修复。
使用命令行工具检查项目、修改代码、执行构建与测试,并通过迭代检查诊断故障。
规划工具调用顺序,解读中间结果,并持续执行直至完成工作流或生成结构化交付物。
对复杂的数学、科学、网络安全与工程问题进行深入推理,生成分步骤解答或调查方案。
审阅大规模文本或源代码,追踪相隔较远内容之间的关系,并生成整合分析结果。
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| 指数分数 | ||
|---|---|---|
| Artificial Analysis 综合能力指数 | Artificial Analysis 综合能力评分 | 40.8 |
| Artificial Analysis 代码能力指数 | Artificial Analysis 软件任务评分 | 43.2 |
| 知识与推理 | ||
| GPQA | 高阶科学问题求解 | 90.5% |
| HLE | 广泛专家级考试集合 | 33.5% |
| 代码与工程 | ||
| SciCode | 科学计算代码挑战 | 46.4% |
| Terminal-Bench Hard | 高难度终端任务执行 | 41.7% |
| 指令遵循与 Agent 任务 | ||
| IFBench | 指令约束遵循 | 71.3% |
| AA-LCR | 长上下文推理 | 65% |
| τ²-Bench | Agent 工作流任务 | 94.2% |
指标来源 Artificial Analysis
解答关于 DeepSeek V4 Pro API、价格、代码与推理能力、上下文长度、基准测试和模型对比的常见问题。
DeepSeek V4 Pro 是 DeepSeek 面向旗舰级推理、编程和智能体任务的模型。
适合复杂编程、智能体流程、长上下文分析,尤其适合重视最高回答质量的场景。
核心优势是DeepSeek V4 系列中的高水平推理和智能体编程,并具备可切换的思考与非思考模式。
它会使用更多计算,因此延迟和成本可能更高。 更看重响应速度和成本效率时,可考虑 DeepSeek V4 Flash。
使用 TokenHub 显示的精确标识符,并按账户文档确认当前功能。
应按实际工作负载选择,而不是只看通用排名。请结合所需输入模态、API 价格、输出量、延迟、工具调用和自己的生产评测结果,对比 DeepSeek V4 Pro 与 Kimi K3。
请查看上方当前模型数据中的 DeepSeek V4 Pro 上下文长度和最大输出。上下文长度决定单次请求可包含多少资料,最大输出决定单次响应可生成多少内容。
通过一个 API Key 接入 DeepSeek V4 Pro 与更多 AI 模型。
媒体与讨论
精选与此模型相关的公开视频和帖子。
X (Twitter)
Reddit
YouTube