模型廣場

在一個生產級目錄中查看 AI 模型價格、能力、端點和供應商覆蓋。

OpenAI

GPT-6.1 Sol

gpt-6.1-sol

GPT-6.1 Sol 是一款先進的推理模型,專為複雜問題解決、程式開發與代理式應用打造。其設計目標是在提供強大推理效能的同時,於智慧、速度與成本之間取得實用平衡。 有別於主要著重生成回覆的傳統聊天模型,GPT-6.1 Sol 針對需要更深入思考的任務進行最佳化,包括多步推理、程式碼生成、除錯、資料分析,以及遵循複雜指令。 GPT-6.1 Sol 支援可靠的推理工作流程、結構化輸出與工具型應用,適合開發 AI 助理、程式開發代理、自動化系統與生產級 AI 應用的開發者。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年9月29日

輸入$2 / 百萬 Token
輸出$10 / 百萬 Token
快取讀取$0.1 / 百萬 Token

OpenAI

GPT-6.1 Sol Pro

gpt-6.1-sol-pro

GPT-6.1 Sol Pro 是 GPT-6.1 Sol 的增強推理版本。它使用與 GPT-6.1 Sol 相同的底層模型,但啟用 reasoning.mode=pro,讓模型能在每次請求中投入顯著更多運算資源。 額外的推理預算有助於 GPT-6.1 Sol Pro 處理需要更深入分析、更長規劃和更高準確度的難題。它專為追求最佳答案比回應速度或成本效益更重要的任務而設計。 與 GPT-6.1 Sol 相比,GPT-6.1 Sol Pro 每次請求會消耗顯著更多推理 token,因此使用成本更高、回應時間更長。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年9月29日

輸入$2 / 百萬 Token
輸出$10 / 百萬 Token
快取讀取$0.1 / 百萬 Token

Anthropic

Claude Sonnet 5.5

claude-sonnet-5.5

Claude Sonnet 5.5 是新一代 AI 模型,專為進階推理、程式編寫、分析與複雜代理式工作流程而設計。它在軟體開發、長脈絡理解、多模態任務與專業知識工作上表現出色,兼具智慧、速度與效率。憑藉強化的推理能力與更優異的指令遵循表現,Claude Sonnet 5.5 擅長撰寫與除錯程式碼、分析複雜文件、解決多步驟問題,並驅動需要可靠決策與工具使用的 AI 代理。

最大上下文

1M

最大輸出

128K

發布日期

2026年9月28日

輸入$2 / 百萬 Token
輸出$10 / 百萬 Token
快取讀取$0.2 / 百萬 Token

xAI

Grok 4.7

grok-4.7

Grok 4.7 是 xAI 最新一代模型,專為高難度程式開發任務、複雜推理與知識密集型應用而設計。它強化長時程問題求解、自我驗證與工作流程執行能力,適合開發者打造智慧助理與 AI 驅動產品。 Grok 4.7 在程式設計、分析與通用 AI 任務上表現出色,同時為生產環境部署維持具競爭力的效率。

最大上下文

500K

最大輸出

500K

發布日期

2026年9月21日

輸入$1.6 / 百萬 Token
輸出$4.8 / 百萬 Token
快取讀取$0.4 / 百萬 Token

Anthropic

Claude Opus 5.5

claude-opus-5.5

Claude Opus 5.5 是 Anthropic 的旗艦智慧模型,專為需要深度推理、高可靠性與長時間任務執行的嚴苛工作負載而設計。它在軟體工程、代理工作流程、專業分析以及知識密集型任務中均表現出色。 憑藉更高的效率與強化的安全防護,Claude Opus 5.5 專為打造複雜 AI 應用的開發者而最佳化,可在各類複雜任務中提供穩定一致的效能。

最大上下文

1M

最大輸出

128K

發布日期

2026年9月22日

輸入$4 / 百萬 Token
輸出$20 / 百萬 Token
快取讀取$0.2 / 百萬 Token

OpenAI

GPT-6 Sol

gpt-6-sol

GPT-6 Sol 是 OpenAI GPT-6 系列中的高效能模型,專為複雜推理任務、軟體開發與專業 AI 工作流程而設計。它在多步驟問題求解、進階程式開發、資料分析以及代理式應用上提供更強的智慧表現。 GPT-6 Sol 兼具強大的推理能力與高效率的推論效能,適合需要前沿級效能來打造正式環境 AI 系統的開發者。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年9月22日

輸入$2 / 百萬 Token
輸出$10 / 百萬 Token
快取讀取$0.2 / 百萬 Token

OpenAI

GPT-6 Sol Pro

gpt-6-sol-pro

GPT-6 Sol Pro 是 GPT-6 Sol 的增強推理變體,專為需要更深入分析、更高準確度與更可靠多步驟執行的任務而設計。 憑藉更強的推理能力,GPT-6 Sol Pro 在軟體工程、複雜工作流程、資料分析與 AI 代理應用中展現更佳效能。它針對建構進階 AI 系統的開發者進行最佳化,能在高難度任務上提供一致結果。 GPT-6 Sol Pro 支援長上下文處理、工具呼叫與結構化輸出,適合需要強大推理與自動化能力的生產級應用。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年9月22日

輸入$2 / 百萬 Token
輸出$10 / 百萬 Token
快取讀取$0.2 / 百萬 Token

OpenAI

GPT-6 Luna

gpt-6-luna

GPT-6 Luna 是 OpenAI GPT-6 系列中一款精巧高效的模型,旨在以大幅提升的成本效益提供強大的語言智慧。它為對話式 AI、內容生成、程式輔助與自動化工作流程等日常 AI 應用提供可靠效能。憑藉大型上下文視窗與最佳化推論效率,GPT-6 Luna 非常適合打造可擴展 AI 產品、需要高吞吐量、低延遲與可預測營運成本的開發者。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年9月22日

輸入$0.1 / 百萬 Token
輸出$0.5 / 百萬 Token
快取讀取$0.01 / 百萬 Token

OpenAI

GPT-6 Luna Pro

gpt-6-luna-pro

GPT-6 Luna Pro 是 GPT-6 Luna 的推理最佳化版本,旨在提供更強大的問題解決能力,同時維持 Luna 系列的高效率與經濟性。 相較於標準快速推論模型,它在複雜指令、程式編寫任務、分析工作流程與輕量級代理應用上表現更佳。GPT-6 Luna Pro 非常適合需要更高品質回應,同時維持生產工作負載可擴展性的開發者。 支援長上下文處理、函式呼叫與結構化輸出,在智慧、速度與成本效率之間取得平衡。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年9月22日

輸入$0.1 / 百萬 Token
輸出$0.5 / 百萬 Token
快取讀取$0.01 / 百萬 Token

Alibaba

Qwen3.8 Omni Flash

qwen3.8-omni-flash

Qwen3.8 Omni Flash 是阿里巴巴 Qwen 家族的新一代全模態模型,旨在於統一的 AI 系統中理解並處理文字、圖像、音訊與影片。它結合強大的語言智慧與先進的多模態理解能力,適用於真實世界的 AI 應用。 支援最高 100 萬 token 的上下文視窗,Qwen3.8 Omni Flash 針對長文件分析、多媒體理解與代理式工作流程進行最佳化。它能分析複雜的音訊與影片內容,跨多種模態進行推理,並支援工具呼叫,以建構智慧 AI 應用程式。 為高效率部署而設計,Qwen3.8 Omni Flash 在多模態智慧、可擴展性與成本效率之間取得出色平衡,適合開發者建構下一代 AI 助理、內容分析系統與自動化代理。

最大上下文

1M

最大輸出

131.1K

發布日期

2026年9月17日

輸入$0.1143 / 百萬 Token
輸出$0.3857 / 百萬 Token
快取讀取$0.0143 / 百萬 Token

TypeSafe

Jev 1.13

jev-1.13

Jev 1.13 是 TypeSafe AI 的首個 System One 決策模型,專為結構化 AI 判斷而非文字生成而設計。它會分析提供的上下文,並回傳結構化選項、分數與基於置信度的決策。Jev 適用於分類、路由、評估與自動化工作流程,以低延遲和高效 token 使用提供快速、可預測的 AI 決策。

最大上下文

32K

最大輸出

暫無

發布日期

2026年9月18日

輸入$0.042 / 百萬 Token
輸出$0 / 百萬 Token

Z.ai

GLM-5.3-FlashX

glm-5.3-flashx

GLM-5.3-FlashX 是 Z.ai 推出的高速多模態模型,專為快速、靈敏的推理而設計,同時保留 GLM-5.3-Flash 的核心能力。它支援文字、圖像、影片和檔案輸入,上下文視窗最高可達 100 萬 tokens。 該模型在程式編寫、代理式工作流程、視覺理解、長上下文任務和複雜推理方面表現出色,是需要兼顧速度與智慧的即時 AI 應用程式的理想選擇。

最大上下文

1M

最大輸出

131.1K

發布日期

2026年9月18日

輸入$0.2857 / 百萬 Token
輸出$1 / 百萬 Token
快取讀取$0.0814 / 百萬 Token

DeepSeek

DeepSeek V4.1 Flash

deepseek-v4.1-flash

DeepSeek-V4.1-Flash 是一款快速且高效的多模態 AI 模型,具備先進的推理、編碼和代理能力。支援高達 100 萬 tokens 的上下文與原生視覺理解,以更低的推論成本提供前沿級智慧,非常適合 AI 代理、自動化、編碼助理和可擴展應用。

最大上下文

1M

最大輸出

384K

發布日期

2026年9月10日

輸入$0.2857 / 百萬 Token
輸出$1.1429 / 百萬 Token
快取讀取$0.0057 / 百萬 Token

OpenAI

GPT-6 Astra

gpt-6-astra

GPT-6 Astra 是 OpenAI 的次世代旗艦模型,專為複雜推理、軟體工程、AI 代理、研究及高要求的端到端專業工作流程而設計。它在程式碼、瀏覽器和專業軟體的多步驟任務中表現出色,在問題解決、工具使用、電腦使用與長上下文理解上都有更強效能。 GPT-6 Astra 支援最高 1.05M token 的上下文視窗與最多 128K token 的輸出,並提供 Low、Medium、High、XHigh 與 Max 多種推理力度,讓開發者可依任務複雜度在推理能力、效率與成本之間取得平衡。 此模型非常適合進階 AI 代理、複雜軟體開發、自動化工作流程、深度研究、長文件處理、資料分析與企業級 AI 應用。

最大上下文

1.1M

最大輸出

128K

發布日期

2026年9月4日

輸入$10 / 百萬 Token
輸出$50 / 百萬 Token
快取讀取$1 / 百萬 Token

Anthropic

Claude Fable 5.1

claude-fable-5.1

Claude Fable 5 是 Anthropic 的 Mythos 級模型,專為高難度推理、軟體工程、知識工作、視覺分析和科學研究而設計。它針對長週期代理任務而生,能在複雜工作流程中持續規劃與執行,分析大型程式碼庫與文件,並透過多步驟迭代持續改進成果。Claude Fable 5 非常適合需要進階編程、研究、專業分析及可靠自主任務完成的實際應用。

最大上下文

1M

最大輸出

128K

發布日期

2026年9月1日

輸入$10 / 百萬 Token
輸出$50 / 百萬 Token
快取讀取$0.25 / 百萬 Token

Z.ai

GLM-5.3-Flash

glm-5.3-flash

GLM-5.3-Flash 是 Z.ai 在 GLM-5 系列中推出的首款原生多模態模型,專為快速程式碼編寫、視覺理解與代理工作流程而設計。其 320B 參數 MoE 架構每個 token 啟動 18B 參數,並結合稀疏注意力與線性注意力,讓長上下文任務更有效率。可透過 TokenHub 使用 GLM API,在部署至正式環境的程式碼編寫或多模態代理任務前,先評估目前的 GLM-5.3-Flash 價格、模型 ID、支援的輸入、工具呼叫、內容限制與端點。

最大上下文

1M

最大輸出

131.1K

發布日期

2026年8月26日

輸入$0.1143 / 百萬 Token
輸出$0.4 / 百萬 Token
快取讀取$0.0329 / 百萬 Token

Z.ai

GLM-5.3

glm-5.3

GLM-5.3 是 Z.ai 最新的旗艦模型,專為進階編碼、軟體工程和長期代理任務而打造。具備 1M token 上下文視窗、最高 128K 輸出 token、強大推理與工具使用能力,適用於編碼代理、複雜開發流程和多步驟自動化。

最大上下文

1M

最大輸出

128K

發布日期

2026年8月19日

輸入$1.1429 / 百萬 Token
輸出$4 / 百萬 Token
快取讀取$0.2857 / 百萬 Token

Tencent

Hy4 preview

hy4-preview

Hy4 preview 是騰訊混元(Tencent Hunyuan)的下一代開源 MoE 旗艦模型,專為編碼、辦公、科學研究、長上下文推理與複雜代理工作流等實際生產力任務而設計。又稱 Tencent Hy4 preview 或 Hunyuan 4 preview,總參數量 770B,每個 token 啟動 49B 參數,並支援超過 1M token 的上下文窗口。模型擅長理解大型程式碼庫與文件、多步規劃、工具使用、除錯、驗證及持續任務執行。

最大上下文

1M

最大輸出

64K

發布日期

2026年8月28日

輸入$0.8571 / 百萬 Token
輸出$2.5714 / 百萬 Token
快取讀取$0.0429 / 百萬 Token

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max 是一款擁有2.4兆參數的MoE旗艦模型,專為進階推理、程式設計和企業生產力而設計。它能自主執行複雜的長期任務——從軟體開發到專業工作流程——在法律、金融和設計等領域提供生產級成果。憑藉原生多模態智能,Qwen3.8-Max 能理解長上下文中的文字、圖像和影片,支援對大量文件和長篇內容的深度分析。其智慧體能力支援在複雜工作流程中自主規劃、執行、驗證和持續迭代。

最大上下文

1M

最大輸出

128K

發布日期

2026年8月3日

輸入$2 / 百萬 Token
輸出$6 / 百萬 Token
快取讀取$0.25 / 百萬 Token

Moonshot

Kimi K3

kimi-k3

Kimi K3 是 Moonshot AI 面向長上下文程式開發、複雜推理與知識工作的旗艦模型。Kimi K3 支援原生視覺輸入與 1M token 上下文視窗,適合程式碼庫分析、長文件研究、多步驟 Agent 工作流與正式環境 AI 應用。你可以透過 TokenHub 查看 Kimi K3 API、Kimi K3 價格、模型能力與 benchmark 結果,再決定是否用於實際業務。

最大上下文

1M

最大輸出

131.1K

發布日期

2026年7月16日

輸入$2.8571 / 百萬 Token
輸出$14.2857 / 百萬 Token
快取讀取$0.2857 / 百萬 Token

DeepSeek

DeepSeek V4 Flash Vision Exp

deepseek-v4-flash-vision-exp

DeepSeek V4 Flash Vision Exp 是 DeepSeek V4 Flash 0731 的實驗性視覺增強版本,在保持基礎模型文字效能(包括智慧體能力、推理和世界知識)的同時,引入影像理解功能。它基於稀疏混合專家(MoE)架構,總參數為284B,啟用參數為13B。

最大上下文

1M

最大輸出

384K

發布日期

2026年8月21日

輸入$0.2857 / 百萬 Token
輸出$1.1429 / 百萬 Token
快取讀取$0.0057 / 百萬 Token

熱門模型推薦

從即時目錄中優先查看高關注模型,再進入詳情頁比較上下文、端點和實際價格。

OpenAI

GPT-6.1 Sol

GPT-6.1 Sol 是一款先進的推理模型,專為複雜問題解決、程式開發與代理式應用打造。其設計目標是在提供強大推理效能的同時,於智慧、速度與成本之間取得實用平衡。 有別於主要著重生成回覆的傳統聊天模型,GPT-6.1 Sol 針對需要更深入思考的任務進行最佳化,包括多步推理、程式碼生成、除錯、資料分析,以及遵循複雜指令。 GPT-6.1 Sol 支援可靠的推理工作流程、結構化輸出與工具型應用,適合開發 AI 助理、程式開發代理、自動化系統與生產級 AI 應用的開發者。

最大上下文

1.1M

輸入價格

$2 / 百萬 Token

查看模型

OpenAI

GPT-6.1 Sol Pro

GPT-6.1 Sol Pro 是 GPT-6.1 Sol 的增強推理版本。它使用與 GPT-6.1 Sol 相同的底層模型,但啟用 reasoning.mode=pro,讓模型能在每次請求中投入顯著更多運算資源。 額外的推理預算有助於 GPT-6.1 Sol Pro 處理需要更深入分析、更長規劃和更高準確度的難題。它專為追求最佳答案比回應速度或成本效益更重要的任務而設計。 與 GPT-6.1 Sol 相比,GPT-6.1 Sol Pro 每次請求會消耗顯著更多推理 token,因此使用成本更高、回應時間更長。

最大上下文

1.1M

輸入價格

$2 / 百萬 Token

查看模型

Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5 是新一代 AI 模型,專為進階推理、程式編寫、分析與複雜代理式工作流程而設計。它在軟體開發、長脈絡理解、多模態任務與專業知識工作上表現出色,兼具智慧、速度與效率。憑藉強化的推理能力與更優異的指令遵循表現,Claude Sonnet 5.5 擅長撰寫與除錯程式碼、分析複雜文件、解決多步驟問題,並驅動需要可靠決策與工具使用的 AI 代理。

最大上下文

1M

輸入價格

$2 / 百萬 Token

查看模型

xAI

Grok 4.7

Grok 4.7 是 xAI 最新一代模型,專為高難度程式開發任務、複雜推理與知識密集型應用而設計。它強化長時程問題求解、自我驗證與工作流程執行能力,適合開發者打造智慧助理與 AI 驅動產品。 Grok 4.7 在程式設計、分析與通用 AI 任務上表現出色,同時為生產環境部署維持具競爭力的效率。

最大上下文

500K

輸入價格

$1.6 / 百萬 Token

查看模型

Anthropic

Claude Opus 5.5

Claude Opus 5.5 是 Anthropic 的旗艦智慧模型,專為需要深度推理、高可靠性與長時間任務執行的嚴苛工作負載而設計。它在軟體工程、代理工作流程、專業分析以及知識密集型任務中均表現出色。 憑藉更高的效率與強化的安全防護,Claude Opus 5.5 專為打造複雜 AI 應用的開發者而最佳化,可在各類複雜任務中提供穩定一致的效能。

最大上下文

1M

輸入價格

$4 / 百萬 Token

查看模型

OpenAI

GPT-6 Sol

GPT-6 Sol 是 OpenAI GPT-6 系列中的高效能模型,專為複雜推理任務、軟體開發與專業 AI 工作流程而設計。它在多步驟問題求解、進階程式開發、資料分析以及代理式應用上提供更強的智慧表現。 GPT-6 Sol 兼具強大的推理能力與高效率的推論效能,適合需要前沿級效能來打造正式環境 AI 系統的開發者。

最大上下文

1.1M

輸入價格

$2 / 百萬 Token

查看模型

模型比較

與選定的相鄰目錄模型快速比較。

模型目錄常見問題

快速了解如何在 TokenHub 目錄中選擇、比較和使用模型。

應該如何從列表中選擇模型?

+

先看你的具體任務。可以按供應商、標籤、端點類型和計費分組篩選,再比較上下文長度、最大輸出、模態能力以及輸入或輸出價格。

實際價格是什麼意思?

+

實際價格會把目前計費分組倍率套用到模型價格資料上,幫助你估算所使用分組下真實的輸入、輸出或按次呼叫成本。

這些模型都可以透過 API 端點使用嗎?

+

可以進入模型詳情頁查看支援的端點類型和文件連結。可用性會因模型、供應商和目前路由配置而不同。

為什麼上下文窗口和最大輸出很重要?

+

上下文窗口決定模型能讀取多少提示詞和對話歷史;最大輸出決定單次回應能生成多少內容,對長文寫作、程式碼和文件任務尤其重要。