模型廣場

在一個生產級目錄中查看 AI 模型價格、能力、端點和供應商覆蓋。

Moonshot

Kimi K3

kimi-k3

Kimi K3 是一款高效能 AI 模型,專為進階推理、程式編碼及複雜任務執行而設計。它在大規模程式開發專案、多步驟問題解決和知識密集型應用中展現卓越效能。具備廣泛的上下文處理能力和多模態功能,K3 適合打造強大的 AI 代理、開發人員工具和企業級應用。

最大上下文

1M

最大輸出

131.1K

發布日期

2026年7月16日

輸入$2.8571 / 百萬 Token
輸出$14.2857 / 百萬 Token
快取讀取$0.2857 / 百萬 Token

OpenAI

GPT-5.5

gpt-5.5

GPT-5.5 被 OpenAI 描述为更智能的前沿模型,面向程式碼、研究、数据分析和專業知識工作。官方發布信息強調它在能力、速度和文件/结构化分析任務上的提升。它的描述应聚焦广泛的專業智能,而不是某一个单一细分場景。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年4月23日

輸入$5 / 百萬 Token
輸出$30 / 百萬 Token
快取讀取$0.5 / 百萬 Token

DeepSeek

DeepSeek V4 Pro

deepseek-v4-pro

DeepSeek V4 Pro 被描述為大规模 MoE 模型,拥有 1.6T 總參數与 49B 啟用參數,并支援 1M token 上下文窗口,適合處理超長輸入。官方和第三方模型卡更強調它在高階推理、程式碼任務和長周期 Agent 工作流程中的能力,而不是一般聊天。相較於 V4 Flash,Pro 更偏向能力上限,適合大型程式碼库分析、複雜研究資料整合、多步驟自動化等需要深度推理的任務。

最大上下文

1M

最大輸出

384K

發布日期

2026年4月24日

輸入$1.8 / 百萬 Token
輸出$3.5 / 百萬 Token
快取讀取$0.015 / 百萬 Token

DeepSeek

DeepSeek V4 Flash

deepseek-v4-flash

DeepSeek V4 Flash 保留了 V4 系列的 1M token 長上下文能力,但採用更輕量的 MoE 配置,常见模型卡描述为 284B 總參數、13B 啟用參數。它的重點不是最大推理深度,而是更快推理、更低調用成本和更適合生產環境的吞吐量。对于高頻請求、批次處理和長上下文但不一定需要最高推理强度的任務,Flash 会比 Pro 更合适。

最大上下文

1M

最大輸出

384K

發布日期

2026年4月24日

輸入$0.15 / 百萬 Token
輸出$0.3 / 百萬 Token
快取讀取$0.003 / 百萬 Token

Alibaba

Qwen3.7 Plus

qwen3.7-plus

Qwen3.7 Plus 延续 Qwen3.7 面向 Agent 的设计方向,但更偏向性价比。第三方模型卡描述它支援文字和圖片輸入,并强化視覺语言能力,以及 GUI、移动端导航、視覺参考等混合 Agent 任務。它適合需要 Qwen3.7 新一代能力,但不一定需要 Max 档位成本的場景。

最大上下文

1M

最大輸出

64K

發布日期

2026年6月2日

輸入$0.2857 / 百萬 Token
輸出$1.1429 / 百萬 Token
快取讀取$0.0571 / 百萬 Token

OpenAI

GPT-4.1

gpt-4.1

GPT-4.1 是 OpenAI 強調程式碼、指令遵循和長上下文能力提升的一代模型。官方發布信息将它描述为在许多编程和指令密集型任務上强于 GPT-4o 的開發者模型。它的描述应突出程式碼可靠性和長上下文理解。

最大上下文

1M

最大輸出

32.8K

發布日期

2025年4月14日

輸入$2 / 百萬 Token
輸出$8 / 百萬 Token
快取讀取$0.5 / 百萬 Token

OpenAI

GPT-4.1 Mini

gpt-4.1-mini

GPT-4.1 Mini 将 GPT-4.1 系列的程式碼和指令遵循能力,以更快、更低成本的形式提供出来。它適合高頻開發者工具、结构化生成、信息擷取,以及不需要完整大模型能力的產品功能。它的核心差异是保留 4.1 一代任務纪律性的同时提升生產效率。

最大上下文

1M

最大輸出

32.8K

發布日期

2025年4月14日

輸入$0.4 / 百萬 Token
輸出$1.6 / 百萬 Token
快取讀取$0.1 / 百萬 Token

OpenAI

GPT-4o

gpt-4o

GPT-4o 是 OpenAI GPT-4o 一代的多模态旗舰模型,支援文字和圖像輸入,并具备较强的通用智能。官方文件将它描述为適合广泛语言与視覺任務的高智能通用模型。在更看重多模态理解和自然交互,而不是最新推理栈的場景中,它仍然有价值。

最大上下文

128K

最大輸出

16.4K

發布日期

2024年5月13日

輸入$2.5 / 百萬 Token
輸出$10 / 百萬 Token
快取讀取$1.25 / 百萬 Token

OpenAI

GPT-4o Mini

gpt-4o-mini

GPT-4o Mini 是 GPT-4o 家族中的快速、低成本小模型。OpenAI 文件将其定位为面向聚焦任務的模型,支援文字和圖像輸入、结构化輸出、微调和蒸馏工作流程。它更適合被介绍为輕量级多模态生產模型,而不是 GPT-4o 的简单缩小版。

最大上下文

128K

最大輸出

16.4K

發布日期

2024年7月18日

輸入$0.15 / 百萬 Token
輸出$0.6 / 百萬 Token
快取讀取$0.075 / 百萬 Token

OpenAI

GPT-5.3 Chat

gpt-5.3-chat

gpt-5.3-chat 是 GPT-5.3 Instant 在 API 中的模型名稱,主要對應 ChatGPT 中用於日常對話的快照版本。OpenAI 對該版本的定位是讓一般對話更流暢、更直接、更有幫助,並提升答案準確性、聯網搜尋時的上下文組織能力,同時減少不必要的聲明、繞行表達與過度謹慎措辭。需要注意的是,官方 API 文件已將該模型標記為 deprecated,更推薦使用更新的 GPT 模型。

最大上下文

128K

最大輸出

16.4K

發布日期

2026年3月3日

輸入$1.75 / 百萬 Token
輸出$14 / 百萬 Token
快取讀取$0.175 / 百萬 Token

OpenAI

GPT-5.3 Codex

gpt-5.3-codex

gpt-5.3-codex 是 OpenAI 面向 Codex 與類似開發環境的 Agentic Coding 模型。它將前沿軟體工程能力與更廣泛的推理和專業知識能力結合起來,支援可配置的 reasoning effort,並在官方模型頁中列出 400K 上下文窗口與 128K 最大輸出。OpenAI 對它的定位不只是寫程式和審查程式,而是進一步支援電腦使用、終端任務、Web 應用迭代與長週期真實工程任務。

最大上下文

400K

最大輸出

128K

發布日期

2026年2月5日

輸入$1.75 / 百萬 Token
輸出$14 / 百萬 Token
快取讀取$0.175 / 百萬 Token

OpenAI

GPT-5.4

gpt-5.4

GPT-5.4 被 OpenAI 定位为兼具能力和效率的前沿模型,面向專業工作。官方資料強調程式碼、原生運算机使用、表格/文件/演示文稿工作流程、事實性改进和大上下文能力。它適合被介绍为把推理能力和真實生產力任務连接起来的实用工作模型。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年3月5日

輸入$2.5 / 百萬 Token
輸出$15 / 百萬 Token
快取讀取$0.25 / 百萬 Token

OpenAI

GPT-5.4 Mini

gpt-5.4-mini

GPT-5.4 Mini 是 GPT-5.4 家族中更小、更快的版本。OpenAI 文件将 mini 模型定位为低延遲工作负载,同时保留程式碼、工具調用、多模态推理和较强指令遵循。它適合边界清晰的生產任務、子 Agent,以及需要大量快速調用的应用。

最大上下文

400K

最大輸出

128K

發布日期

2026年3月17日

輸入$0.75 / 百萬 Token
輸出$4.5 / 百萬 Token
快取讀取$0.075 / 百萬 Token

OpenAI

GPT-5.4 Nano

gpt-5.4-nano

GPT-5.4 Nano 是 GPT-5.4 中成本最低、体量最小的版本,適合大量简单任務。OpenAI 的模型說明将 nano 模型与低延遲和成本效率关联,而不是最大推理深度。它更適合分類、路由、擷取、輕量生成等可预测工作流程。

最大上下文

400K

最大輸出

128K

發布日期

2026年3月17日

輸入$0.2 / 百萬 Token
輸出$1.25 / 百萬 Token
快取讀取$0.02 / 百萬 Token

OpenAI

GPT-5.4 Pro

gpt-5.4-pro

GPT-5.4 Pro 是 GPT-5.4 中更強調精度和輸出品質的高阶版本,面向要求更高的專業任務。OpenAI 的模型說明将 Pro 与标准版区分在更强推理和更高準確性预期上。在模型列表中,它適合被描述為複雜分析、高难度程式碼和高要求知識工作的选择。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年3月5日

輸入$30 / 百萬 Token
輸出$180 / 百萬 Token

OpenAI

GPT-5.5 Pro

gpt-5.5-pro

GPT-5.5 Pro 是 OpenAI GPT-5.5 一代中使用更多運算资源的高阶版本,適合答案品質比速度更重要的高难度專業任務。OpenAI 資料将 Pro 档描述为会“思考得更深”,在程式碼、研究、数据分析和文件密集型工作中追求更高精度。它应被定位为面向複雜推理和專業交付的模型,而不是日常聊天模型。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年4月23日

輸入$30 / 百萬 Token
輸出$180 / 百萬 Token

OpenAI

GPT-5.6 Luna

gpt-5.6-luna

GPT-5.6 Luna 是 Luna 系列的通用版本,適用於日常 AI 應用。可用於聊天問答、文本改寫、摘要、資訊擷取、簡單推理、程式輔助及辦公室自動化。 Luna 是原型設計、輕量商業功能、批次內容處理和常見使用者互動情境的實用選擇。當速度、簡潔和成本控制很重要時,它是一個很好的入門模型;需要更高品質或更穩定的輸出時,可考慮使用 Luna Pro。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$1 / 百萬 Token
輸出$6 / 百萬 Token
快取讀取$0.1 / 百萬 Token

OpenAI

GPT-5.6 Luna Pro

gpt-5.6-luna-pro

GPT-5.6 Luna Pro 是 Luna 系列的增強版本,旨在提供更高品質的回答、更穩定的指令遵循與更強的任務完成能力。適用於複雜對話、內容生成、知識問答、商業分析、程式碼輔助及多步驟自動化任務。 Luna Pro 特別適合在輸出品質與使用者體驗至關重要的產品中,例如專業寫作助手、企業 AI 助手、客戶支援、知識庫系統和代理工作流程。若任務需要比標準 Luna 模型更可靠時,這會是理想的選擇。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$1 / 百萬 Token
輸出$6 / 百萬 Token
快取讀取$0.1 / 百萬 Token

OpenAI

GPT-5.6 Sol

gpt-5.6-sol

GPT-5.6 Sol 是 Sol 系列的標準版本,適合一般問答、文本處理、內容草擬、摘要生成、輕量程式碼輔助與業務自動化任務。 Sol 專為需要紮實通用能力、同時兼顧回應效率與成本的場景設計,可用於產品功能、聊天助理、內容生成工具、資料清理、知識庫問答及批次處理任務。針對大規模使用或快速原型開發,Sol 是一個靈活的起點。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$5 / 百萬 Token
輸出$30 / 百萬 Token
快取讀取$0.5 / 百萬 Token

OpenAI

GPT-5.6 Sol Pro

gpt-5.6-sol-pro

GPT-5.6 Sol Pro 是 Sol 系列的專業版,專為複雜任務和更高品質輸出而設計。適用於高階寫作、精準問答、商業推理、程式碼生成、結構化分析及多輪任務執行。 Sol Pro 特別適合需要更強準確性、上下文理解與指令完成度的任務,可用於專業內容製作、資料分析助手、知識問答系統、複雜代理工作流程,以及企業內部 AI 工具。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$5 / 百萬 Token
輸出$30 / 百萬 Token
快取讀取$0.5 / 百萬 Token

OpenAI

GPT-5.6 Terra

gpt-5.6-terra

GPT-5.6 Terra 是 Terra 系列的通用版本,適用於日常對話、文本生成、摘要、資訊提取、輕量推理和程式碼輔助。 Terra 在泛用能力、回應效率與成本之間取得了實用的平衡。可用於聊天助理、內容工具、辦公室自動化、知識庫問答及批次文本處理工作流程。對於快速迭代或成本敏感的應用,Terra 是 Terra 系列中的理想預設選項。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$2.5 / 百萬 Token
輸出$15 / 百萬 Token
快取讀取$0.275 / 百萬 Token

熱門模型推薦

從即時目錄中優先查看高關注模型,再進入詳情頁比較上下文、端點和實際價格。

Moonshot

Kimi K3

Kimi K3 是一款高效能 AI 模型,專為進階推理、程式編碼及複雜任務執行而設計。它在大規模程式開發專案、多步驟問題解決和知識密集型應用中展現卓越效能。具備廣泛的上下文處理能力和多模態功能,K3 適合打造強大的 AI 代理、開發人員工具和企業級應用。

最大上下文

1M

輸入價格

$2.8571 / 百萬 Token

查看模型

OpenAI

GPT-5.5

GPT-5.5 被 OpenAI 描述为更智能的前沿模型,面向程式碼、研究、数据分析和專業知識工作。官方發布信息強調它在能力、速度和文件/结构化分析任務上的提升。它的描述应聚焦广泛的專業智能,而不是某一个单一细分場景。

最大上下文

1.1M

輸入價格

$5 / 百萬 Token

查看模型

DeepSeek

DeepSeek V4 Pro

DeepSeek V4 Pro 被描述為大规模 MoE 模型,拥有 1.6T 總參數与 49B 啟用參數,并支援 1M token 上下文窗口,適合處理超長輸入。官方和第三方模型卡更強調它在高階推理、程式碼任務和長周期 Agent 工作流程中的能力,而不是一般聊天。相較於 V4 Flash,Pro 更偏向能力上限,適合大型程式碼库分析、複雜研究資料整合、多步驟自動化等需要深度推理的任務。

最大上下文

1M

輸入價格

$1.8 / 百萬 Token

查看模型

DeepSeek

DeepSeek V4 Flash

DeepSeek V4 Flash 保留了 V4 系列的 1M token 長上下文能力,但採用更輕量的 MoE 配置,常见模型卡描述为 284B 總參數、13B 啟用參數。它的重點不是最大推理深度,而是更快推理、更低調用成本和更適合生產環境的吞吐量。对于高頻請求、批次處理和長上下文但不一定需要最高推理强度的任務,Flash 会比 Pro 更合适。

最大上下文

1M

輸入價格

$0.15 / 百萬 Token

查看模型

Alibaba

Qwen3.7 Plus

Qwen3.7 Plus 延续 Qwen3.7 面向 Agent 的设计方向,但更偏向性价比。第三方模型卡描述它支援文字和圖片輸入,并强化視覺语言能力,以及 GUI、移动端导航、視覺参考等混合 Agent 任務。它適合需要 Qwen3.7 新一代能力,但不一定需要 Max 档位成本的場景。

最大上下文

1M

輸入價格

$0.2857 / 百萬 Token

查看模型

OpenAI

GPT-4.1

GPT-4.1 是 OpenAI 強調程式碼、指令遵循和長上下文能力提升的一代模型。官方發布信息将它描述为在许多编程和指令密集型任務上强于 GPT-4o 的開發者模型。它的描述应突出程式碼可靠性和長上下文理解。

最大上下文

1M

輸入價格

$2 / 百萬 Token

查看模型

模型比較

與選定的相鄰目錄模型快速比較。

模型目錄常見問題

快速了解如何在 TokenHub 目錄中選擇、比較和使用模型。

應該如何從列表中選擇模型?

+

先看你的具體任務。可以按供應商、標籤、端點類型和計費分組篩選,再比較上下文長度、最大輸出、模態能力以及輸入或輸出價格。

實際價格是什麼意思?

+

實際價格會把目前計費分組倍率套用到模型價格資料上,幫助你估算所使用分組下真實的輸入、輸出或按次呼叫成本。

這些模型都可以透過 API 端點使用嗎?

+

可以進入模型詳情頁查看支援的端點類型和文件連結。可用性會因模型、供應商和目前路由配置而不同。

為什麼上下文窗口和最大輸出很重要?

+

上下文窗口決定模型能讀取多少提示詞和對話歷史;最大輸出決定單次回應能生成多少內容,對長文寫作、程式碼和文件任務尤其重要。