DeepSeek
DeepSeek V4.1 Flash
最大上下文
1M
最大輸出
384K
發布日期
暫無
deepseek-v3DeepSeek V3 是 V3 系列的通用 MoE 基座模型,常见官方資料描述为 671B 總參數、37B 啟用參數。技术报告強調 MLA、DeepSeekMoE、高效训练,以及较强的通用语言和程式碼能力。在模型列表中,它更適合作为 DeepSeek 的通用对话与程式碼基线模型,而不是单纯的深度推理专用模型。
上下文視窗
128K Token
最大輸出
16K Token
發布日期
2024年12月26日
模態
| 輸入價格 | 輸出價格 | 快取讀取 |
|---|---|---|
| $0.2857/M | $1.1429/M | $0.1143/M |
推理
工具呼叫
Temperature 參數
附件
知識庫
Endpoint 協議
DeepSeek V3 結合高效率的混合專家架構,以及通用語言、推理與程式開發能力。
每個 token 會啟用 6,710 億總參數中的 370 億,在保留模型容量的同時提升推論效率。
可透過單一通用文字模型處理知識問答、數學、程式碼與自然語言工作。
128K token 的內容脈絡視窗可支援分析長篇文件、對話與原始程式碼集合。
DeepSeek V3 適合軟體開發協助、文件分析與通用知識應用等工作。
產生、說明與修改程式碼,協助開發者實作功能並解決程式問題。
檢閱長篇文字、擷取重要資訊,並產出摘要或結構化結論。
回答問題、說明概念,並將提供的資訊整理成清楚且聚焦工作的回應。
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)DeepSeek V3 的能力、適用情境、限制與 TokenHub 使用指南。
DeepSeek V3 是 DeepSeek 針對開放權重的通用文字、程式開發與推理任務推出的模型。
適合一般對話、複雜程式開發、自行託管部署,尤其適合重視部署控制權的情境。
核心優勢是開放權重與高效率的 MoE 架構。
它屬於較早世代,可能缺少後續模型的新能力。 更重視需要最新能力時,可考慮 DeepSeek V4 Pro。
使用 TokenHub 的精確識別碼;託管行為可能與自行託管不同。
透過一個 API Key 接入 DeepSeek V3 與更多 AI 模型。
媒體與討論
精選與此模型相關的公開影片和貼文。
X (Twitter)
Reddit
YouTube