模型廣場

在一個生產級目錄中查看 AI 模型價格、能力、端點和供應商覆蓋。

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max 是一款擁有2.4兆參數的MoE旗艦模型,專為進階推理、程式設計和企業生產力而設計。它能自主執行複雜的長期任務——從軟體開發到專業工作流程——在法律、金融和設計等領域提供生產級成果。憑藉原生多模態智能,Qwen3.8-Max 能理解長上下文中的文字、圖像和影片,支援對大量文件和長篇內容的深度分析。其智慧體能力支援在複雜工作流程中自主規劃、執行、驗證和持續迭代。

最大上下文

1M

最大輸出

128K

發布日期

2026年8月3日

輸入$2 / 百萬 Token
輸出$6 / 百萬 Token
快取讀取$0.25 / 百萬 Token

Moonshot

Kimi K3

kimi-k3

Kimi K3 是一款高效能 AI 模型,專為進階推理、程式編碼及複雜任務執行而設計。它在大規模程式開發專案、多步驟問題解決和知識密集型應用中展現卓越效能。具備廣泛的上下文處理能力和多模態功能,K3 適合打造強大的 AI 代理、開發人員工具和企業級應用。

最大上下文

1M

最大輸出

131.1K

發布日期

2026年7月16日

輸入$2.8571 / 百萬 Token
輸出$14.2857 / 百萬 Token
快取讀取$0.2857 / 百萬 Token

OpenAI

GPT-5.6 Sol

gpt-5.6-sol

GPT-5.6 Sol 是 Sol 系列的標準版本,適合一般問答、文本處理、內容草擬、摘要生成、輕量程式碼輔助與業務自動化任務。 Sol 專為需要紮實通用能力、同時兼顧回應效率與成本的場景設計,可用於產品功能、聊天助理、內容生成工具、資料清理、知識庫問答及批次處理任務。針對大規模使用或快速原型開發,Sol 是一個靈活的起點。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$5 / 百萬 Token
輸出$30 / 百萬 Token
快取讀取$0.5 / 百萬 Token

OpenAI

GPT-5.6 Sol Pro

gpt-5.6-sol-pro

GPT-5.6 Sol Pro 是 Sol 系列的專業版,專為複雜任務和更高品質輸出而設計。適用於高階寫作、精準問答、商業推理、程式碼生成、結構化分析及多輪任務執行。 Sol Pro 特別適合需要更強準確性、上下文理解與指令完成度的任務,可用於專業內容製作、資料分析助手、知識問答系統、複雜代理工作流程,以及企業內部 AI 工具。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$5 / 百萬 Token
輸出$30 / 百萬 Token
快取讀取$0.5 / 百萬 Token

OpenAI

GPT-5.6 Terra

gpt-5.6-terra

GPT-5.6 Terra 是 Terra 系列的通用版本,適用於日常對話、文本生成、摘要、資訊提取、輕量推理和程式碼輔助。 Terra 在泛用能力、回應效率與成本之間取得了實用的平衡。可用於聊天助理、內容工具、辦公室自動化、知識庫問答及批次文本處理工作流程。對於快速迭代或成本敏感的應用,Terra 是 Terra 系列中的理想預設選項。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$2.5 / 百萬 Token
輸出$15 / 百萬 Token
快取讀取$0.275 / 百萬 Token

OpenAI

GPT-5.6 Terra Pro

gpt-5.6-terra-pro

GPT-5.6 Terra Pro 是 Terra 系列的增強版本,專為複雜任務中的高品質輸出而設計。適用於進階問答、深度內容創作、商業分析、程式碼輔助和多步驟推理。與標準版相比,Terra Pro 更適合需要更高可靠性、更完整推理和更好指令遵循的場景。適合專業寫作、複雜資訊整合、知識型助手、自動化代理和企業級 AI 應用。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$2.5 / 百萬 Token
輸出$15 / 百萬 Token
快取讀取$0.275 / 百萬 Token

OpenAI

GPT-5.6 Luna

gpt-5.6-luna

GPT-5.6 Luna 是 Luna 系列的通用版本,適用於日常 AI 應用。可用於聊天問答、文本改寫、摘要、資訊擷取、簡單推理、程式輔助及辦公室自動化。 Luna 是原型設計、輕量商業功能、批次內容處理和常見使用者互動情境的實用選擇。當速度、簡潔和成本控制很重要時,它是一個很好的入門模型;需要更高品質或更穩定的輸出時,可考慮使用 Luna Pro。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$1 / 百萬 Token
輸出$6 / 百萬 Token
快取讀取$0.1 / 百萬 Token

OpenAI

GPT-5.6 Luna Pro

gpt-5.6-luna-pro

GPT-5.6 Luna Pro 是 Luna 系列的增強版本,旨在提供更高品質的回答、更穩定的指令遵循與更強的任務完成能力。適用於複雜對話、內容生成、知識問答、商業分析、程式碼輔助及多步驟自動化任務。 Luna Pro 特別適合在輸出品質與使用者體驗至關重要的產品中,例如專業寫作助手、企業 AI 助手、客戶支援、知識庫系統和代理工作流程。若任務需要比標準 Luna 模型更可靠時,這會是理想的選擇。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年7月9日

輸入$1 / 百萬 Token
輸出$6 / 百萬 Token
快取讀取$0.1 / 百萬 Token

DeepSeek

DeepSeek V4 Pro

deepseek-v4-pro

DeepSeek V4 Pro 被描述為大规模 MoE 模型,拥有 1.6T 總參數与 49B 啟用參數,并支援 1M token 上下文窗口,適合處理超長輸入。官方和第三方模型卡更強調它在高階推理、程式碼任務和長周期 Agent 工作流程中的能力,而不是一般聊天。相較於 V4 Flash,Pro 更偏向能力上限,適合大型程式碼库分析、複雜研究資料整合、多步驟自動化等需要深度推理的任務。

最大上下文

1M

最大輸出

384K

發布日期

2026年4月24日

輸入$1.2857 / 百萬 Token
輸出$3.8571 / 百萬 Token
快取讀取$0.0429 / 百萬 Token

Z.ai

GLM-5.2

glm-5.2

GLM-5.2 是 Z.ai 面向長程工程任務的旗艦基礎模型,重點提升了可用的 1M token 上下文能力,可承載專案級程式碼、系統文件與工程背景資訊。它強調長任務執行穩定性、工程規範遵循能力,以及從需求分析、倉庫理解到實作、測試與多平台部署的完整開發流程能力。相比一般對話模型,GLM-5.2 更適合需要大上下文、持續規劃與可靠 Agent 執行的工程場景。

最大上下文

1M

最大輸出

131.1K

發布日期

2026年6月13日

輸入$1.1429 / 百萬 Token
輸出$4 / 百萬 Token
快取讀取$0.2857 / 百萬 Token

DeepSeek

DeepSeek V4 Flash

deepseek-v4-flash

DeepSeek V4 Flash 保留了 V4 系列的 1M token 長上下文能力,但採用更輕量的 MoE 配置,常见模型卡描述为 284B 總參數、13B 啟用參數。它的重點不是最大推理深度,而是更快推理、更低調用成本和更適合生產環境的吞吐量。对于高頻請求、批次處理和長上下文但不一定需要最高推理强度的任務,Flash 会比 Pro 更合适。

最大上下文

1M

最大輸出

384K

發布日期

2026年4月24日

輸入$0.4286 / 百萬 Token
輸出$1.2857 / 百萬 Token
快取讀取$0.0143 / 百萬 Token

Anthropic

Claude Opus 5

claude-opus-5

Claude Opus 5 是 Anthropic 的旗艦模型,專為要求嚴苛的推理、編碼和長期自主任務而設計。它在端到端軟體任務、程式碼審查和錯誤發現、圖表和文件的視覺分析、複雜辦公交付以及協調平行子代理方面尤為出色。該模型在長時間任務中保持強大的指令遵循和工具使用能力,同時在優先考慮延遲和令牌效率的低努力設定下仍然有效。

最大上下文

1M

最大輸出

128K

發布日期

2026年7月24日

輸入$5 / 百萬 Token
輸出$25 / 百萬 Token
快取讀取$0.5 / 百萬 Token

Anthropic

Claude Opus 5 Fast

claude-opus-5-fast

Opus 5 的快速模式變體 - 與常規 Opus 5 相同的效能,但輸出速度更快,價格為常規 Opus 5 的兩倍。 了解更多,請參閱 Anthropic 文件:https://platform.claude.com/docs/en/build-with-claude/fast-mode

最大上下文

1M

最大輸出

128K

發布日期

2026年7月24日

輸入$10 / 百萬 Token
輸出$50 / 百萬 Token
快取讀取$1 / 百萬 Token

xAI

Grok 4.6

grok-4.6

Grok 4.6 是 xAI 的先進推理模型,專為複雜程式設計、長時間執行的代理任務和知識工作而打造。它支援文字和影像輸入,上下文視窗最高可達 50 萬 token,並可設定低/中/高/極高推理強度。藉由函式呼叫、Web 與 X 搜尋、程式碼執行和結構化輸出,Grok 4.6 針對跨程式碼庫分析、持續多步驟工具使用、自我驗證和端到端工程工作流程進行了最佳化。它應被理解為通用推理與代理模型,而不只是與 X 平台相關的聊天機器人。

最大上下文

500K

最大輸出

500K

發布日期

2026年8月12日

輸入$2 / 百萬 Token
輸出$6 / 百萬 Token
快取讀取$0.3 / 百萬 Token

Google

Gemini 3.6 Flash

gemini-3.6-flash

Gemini 3.6 Flash 是來自 Google 的高效模型,適用於編碼、智能代理工作流程以及網頁和應用程式開發。它旨在生成精煉的輸出,減少不必要的編輯和模糊表述,同時降低完成任務所需的 Token 使用量和模型調用次數。

最大上下文

1M

最大輸出

65.5K

發布日期

2026年7月21日

輸入$1.5 / 百萬 Token
輸出$7.5 / 百萬 Token
快取讀取$0.15 / 百萬 Token

xAI

Grok 4.5

grok-4.5

Grok 4.5 是 xAI 針對程式設計、智能體任務與知識工作的推理模型,支援文字和圖像輸入、最高 50 萬 token 上下文,以及低/中/高可配置推理強度。它支援函式呼叫、網頁與 X 搜尋、程式碼執行和結構化輸出,適合長上下文分析、多步驟工具呼叫與端到端工程工作流程;不應僅被定位為與 X 平台關聯的聊天機器人。

最大上下文

500K

最大輸出

500K

發布日期

2026年7月8日

輸入$2 / 百萬 Token
輸出$6 / 百萬 Token
快取讀取$0.3 / 百萬 Token

Alibaba

Qwen3.7 Plus

qwen3.7-plus

Qwen3.7 Plus 延续 Qwen3.7 面向 Agent 的设计方向,但更偏向性价比。第三方模型卡描述它支援文字和圖片輸入,并强化視覺语言能力,以及 GUI、移动端导航、視覺参考等混合 Agent 任務。它適合需要 Qwen3.7 新一代能力,但不一定需要 Max 档位成本的場景。

最大上下文

1M

最大輸出

64K

發布日期

2026年6月2日

輸入$0.2857 / 百萬 Token
輸出$1.1429 / 百萬 Token
快取讀取$0.0571 / 百萬 Token

OpenAI

GPT-4.1

gpt-4.1

GPT-4.1 是 OpenAI 強調程式碼、指令遵循和長上下文能力提升的一代模型。官方發布信息将它描述为在许多编程和指令密集型任務上强于 GPT-4o 的開發者模型。它的描述应突出程式碼可靠性和長上下文理解。

最大上下文

1M

最大輸出

32.8K

發布日期

2025年4月14日

輸入$2 / 百萬 Token
輸出$8 / 百萬 Token
快取讀取$0.5 / 百萬 Token

OpenAI

GPT-4.1 Mini

gpt-4.1-mini

GPT-4.1 Mini 将 GPT-4.1 系列的程式碼和指令遵循能力,以更快、更低成本的形式提供出来。它適合高頻開發者工具、结构化生成、信息擷取,以及不需要完整大模型能力的產品功能。它的核心差异是保留 4.1 一代任務纪律性的同时提升生產效率。

最大上下文

1M

最大輸出

32.8K

發布日期

2025年4月14日

輸入$0.4 / 百萬 Token
輸出$1.6 / 百萬 Token
快取讀取$0.1 / 百萬 Token

OpenAI

GPT-4o

gpt-4o

GPT-4o 是 OpenAI GPT-4o 一代的多模态旗舰模型,支援文字和圖像輸入,并具备较强的通用智能。官方文件将它描述为適合广泛语言与視覺任務的高智能通用模型。在更看重多模态理解和自然交互,而不是最新推理栈的場景中,它仍然有价值。

最大上下文

128K

最大輸出

16.4K

發布日期

2024年5月13日

輸入$2.5 / 百萬 Token
輸出$10 / 百萬 Token
快取讀取$1.25 / 百萬 Token

OpenAI

GPT-4o Mini

gpt-4o-mini

GPT-4o Mini 是 GPT-4o 家族中的快速、低成本小模型。OpenAI 文件将其定位为面向聚焦任務的模型,支援文字和圖像輸入、结构化輸出、微调和蒸馏工作流程。它更適合被介绍为輕量级多模态生產模型,而不是 GPT-4o 的简单缩小版。

最大上下文

128K

最大輸出

16.4K

發布日期

2024年7月18日

輸入$0.15 / 百萬 Token
輸出$0.6 / 百萬 Token
快取讀取$0.075 / 百萬 Token

熱門模型推薦

從即時目錄中優先查看高關注模型,再進入詳情頁比較上下文、端點和實際價格。

Alibaba

Qwen3.8 Max

Qwen3.8-Max 是一款擁有2.4兆參數的MoE旗艦模型,專為進階推理、程式設計和企業生產力而設計。它能自主執行複雜的長期任務——從軟體開發到專業工作流程——在法律、金融和設計等領域提供生產級成果。憑藉原生多模態智能,Qwen3.8-Max 能理解長上下文中的文字、圖像和影片,支援對大量文件和長篇內容的深度分析。其智慧體能力支援在複雜工作流程中自主規劃、執行、驗證和持續迭代。

最大上下文

1M

輸入價格

$2 / 百萬 Token

查看模型

Moonshot

Kimi K3

Kimi K3 是一款高效能 AI 模型,專為進階推理、程式編碼及複雜任務執行而設計。它在大規模程式開發專案、多步驟問題解決和知識密集型應用中展現卓越效能。具備廣泛的上下文處理能力和多模態功能,K3 適合打造強大的 AI 代理、開發人員工具和企業級應用。

最大上下文

1M

輸入價格

$2.8571 / 百萬 Token

查看模型

OpenAI

GPT-5.6 Sol

GPT-5.6 Sol 是 Sol 系列的標準版本,適合一般問答、文本處理、內容草擬、摘要生成、輕量程式碼輔助與業務自動化任務。 Sol 專為需要紮實通用能力、同時兼顧回應效率與成本的場景設計,可用於產品功能、聊天助理、內容生成工具、資料清理、知識庫問答及批次處理任務。針對大規模使用或快速原型開發,Sol 是一個靈活的起點。

最大上下文

1.1M

輸入價格

$5 / 百萬 Token

查看模型

OpenAI

GPT-5.6 Sol Pro

GPT-5.6 Sol Pro 是 Sol 系列的專業版,專為複雜任務和更高品質輸出而設計。適用於高階寫作、精準問答、商業推理、程式碼生成、結構化分析及多輪任務執行。 Sol Pro 特別適合需要更強準確性、上下文理解與指令完成度的任務,可用於專業內容製作、資料分析助手、知識問答系統、複雜代理工作流程,以及企業內部 AI 工具。

最大上下文

1.1M

輸入價格

$5 / 百萬 Token

查看模型

OpenAI

GPT-5.6 Terra

GPT-5.6 Terra 是 Terra 系列的通用版本,適用於日常對話、文本生成、摘要、資訊提取、輕量推理和程式碼輔助。 Terra 在泛用能力、回應效率與成本之間取得了實用的平衡。可用於聊天助理、內容工具、辦公室自動化、知識庫問答及批次文本處理工作流程。對於快速迭代或成本敏感的應用,Terra 是 Terra 系列中的理想預設選項。

最大上下文

1.1M

輸入價格

$2.5 / 百萬 Token

查看模型

OpenAI

GPT-5.6 Terra Pro

GPT-5.6 Terra Pro 是 Terra 系列的增強版本,專為複雜任務中的高品質輸出而設計。適用於進階問答、深度內容創作、商業分析、程式碼輔助和多步驟推理。與標準版相比,Terra Pro 更適合需要更高可靠性、更完整推理和更好指令遵循的場景。適合專業寫作、複雜資訊整合、知識型助手、自動化代理和企業級 AI 應用。

最大上下文

1.1M

輸入價格

$2.5 / 百萬 Token

查看模型

模型比較

與選定的相鄰目錄模型快速比較。

模型目錄常見問題

快速了解如何在 TokenHub 目錄中選擇、比較和使用模型。

應該如何從列表中選擇模型?

+

先看你的具體任務。可以按供應商、標籤、端點類型和計費分組篩選,再比較上下文長度、最大輸出、模態能力以及輸入或輸出價格。

實際價格是什麼意思?

+

實際價格會把目前計費分組倍率套用到模型價格資料上,幫助你估算所使用分組下真實的輸入、輸出或按次呼叫成本。

這些模型都可以透過 API 端點使用嗎?

+

可以進入模型詳情頁查看支援的端點類型和文件連結。可用性會因模型、供應商和目前路由配置而不同。

為什麼上下文窗口和最大輸出很重要?

+

上下文窗口決定模型能讀取多少提示詞和對話歷史;最大輸出決定單次回應能生成多少內容,對長文寫作、程式碼和文件任務尤其重要。