Alibaba
Qwen3.8 Max
Qwen3.8-Max 是一款擁有2.4兆參數的MoE旗艦模型,專為進階推理、程式設計和企業生產力而設計。它能自主執行複雜的長期任務——從軟體開發到專業工作流程——在法律、金融和設計等領域提供生產級成果。憑藉原生多模態智能,Qwen3.8-Max 能理解長上下文中的文字、圖像和影片,支援對大量文件和長篇內容的深度分析。其智慧體能力支援在複雜工作流程中自主規劃、執行、驗證和持續迭代。
最大上下文
1M
最大輸出
128K
發布日期
2026年8月3日
在一個生產級目錄中查看 AI 模型價格、能力、端點和供應商覆蓋。
Alibaba
Qwen3.8 Max
Qwen3.8-Max 是一款擁有2.4兆參數的MoE旗艦模型,專為進階推理、程式設計和企業生產力而設計。它能自主執行複雜的長期任務——從軟體開發到專業工作流程——在法律、金融和設計等領域提供生產級成果。憑藉原生多模態智能,Qwen3.8-Max 能理解長上下文中的文字、圖像和影片,支援對大量文件和長篇內容的深度分析。其智慧體能力支援在複雜工作流程中自主規劃、執行、驗證和持續迭代。
最大上下文
1M
最大輸出
128K
發布日期
2026年8月3日
Moonshot
Kimi K3
Kimi K3 是一款高效能 AI 模型,專為進階推理、程式編碼及複雜任務執行而設計。它在大規模程式開發專案、多步驟問題解決和知識密集型應用中展現卓越效能。具備廣泛的上下文處理能力和多模態功能,K3 適合打造強大的 AI 代理、開發人員工具和企業級應用。
最大上下文
1M
最大輸出
131.1K
發布日期
2026年7月16日
OpenAI
GPT-5.6 Sol
GPT-5.6 Sol 是 Sol 系列的標準版本,適合一般問答、文本處理、內容草擬、摘要生成、輕量程式碼輔助與業務自動化任務。 Sol 專為需要紮實通用能力、同時兼顧回應效率與成本的場景設計,可用於產品功能、聊天助理、內容生成工具、資料清理、知識庫問答及批次處理任務。針對大規模使用或快速原型開發,Sol 是一個靈活的起點。
最大上下文
1.1M
最大輸出
128K
發布日期
2026年7月9日
OpenAI
GPT-5.6 Sol Pro
GPT-5.6 Sol Pro 是 Sol 系列的專業版,專為複雜任務和更高品質輸出而設計。適用於高階寫作、精準問答、商業推理、程式碼生成、結構化分析及多輪任務執行。 Sol Pro 特別適合需要更強準確性、上下文理解與指令完成度的任務,可用於專業內容製作、資料分析助手、知識問答系統、複雜代理工作流程,以及企業內部 AI 工具。
最大上下文
1.1M
最大輸出
128K
發布日期
2026年7月9日
OpenAI
GPT-5.6 Terra
GPT-5.6 Terra 是 Terra 系列的通用版本,適用於日常對話、文本生成、摘要、資訊提取、輕量推理和程式碼輔助。 Terra 在泛用能力、回應效率與成本之間取得了實用的平衡。可用於聊天助理、內容工具、辦公室自動化、知識庫問答及批次文本處理工作流程。對於快速迭代或成本敏感的應用,Terra 是 Terra 系列中的理想預設選項。
最大上下文
1.1M
最大輸出
128K
發布日期
2026年7月9日
OpenAI
GPT-5.6 Terra Pro
GPT-5.6 Terra Pro 是 Terra 系列的增強版本,專為複雜任務中的高品質輸出而設計。適用於進階問答、深度內容創作、商業分析、程式碼輔助和多步驟推理。與標準版相比,Terra Pro 更適合需要更高可靠性、更完整推理和更好指令遵循的場景。適合專業寫作、複雜資訊整合、知識型助手、自動化代理和企業級 AI 應用。
最大上下文
1.1M
最大輸出
128K
發布日期
2026年7月9日
OpenAI
GPT-5.6 Luna
GPT-5.6 Luna 是 Luna 系列的通用版本,適用於日常 AI 應用。可用於聊天問答、文本改寫、摘要、資訊擷取、簡單推理、程式輔助及辦公室自動化。 Luna 是原型設計、輕量商業功能、批次內容處理和常見使用者互動情境的實用選擇。當速度、簡潔和成本控制很重要時,它是一個很好的入門模型;需要更高品質或更穩定的輸出時,可考慮使用 Luna Pro。
最大上下文
1.1M
最大輸出
128K
發布日期
2026年7月9日
OpenAI
GPT-5.6 Luna Pro
GPT-5.6 Luna Pro 是 Luna 系列的增強版本,旨在提供更高品質的回答、更穩定的指令遵循與更強的任務完成能力。適用於複雜對話、內容生成、知識問答、商業分析、程式碼輔助及多步驟自動化任務。 Luna Pro 特別適合在輸出品質與使用者體驗至關重要的產品中,例如專業寫作助手、企業 AI 助手、客戶支援、知識庫系統和代理工作流程。若任務需要比標準 Luna 模型更可靠時,這會是理想的選擇。
最大上下文
1.1M
最大輸出
128K
發布日期
2026年7月9日
DeepSeek
DeepSeek V4 Pro
DeepSeek V4 Pro 被描述為大规模 MoE 模型,拥有 1.6T 總參數与 49B 啟用參數,并支援 1M token 上下文窗口,適合處理超長輸入。官方和第三方模型卡更強調它在高階推理、程式碼任務和長周期 Agent 工作流程中的能力,而不是一般聊天。相較於 V4 Flash,Pro 更偏向能力上限,適合大型程式碼库分析、複雜研究資料整合、多步驟自動化等需要深度推理的任務。
最大上下文
1M
最大輸出
384K
發布日期
2026年4月24日
Z.ai
GLM-5.2
GLM-5.2 是 Z.ai 面向長程工程任務的旗艦基礎模型,重點提升了可用的 1M token 上下文能力,可承載專案級程式碼、系統文件與工程背景資訊。它強調長任務執行穩定性、工程規範遵循能力,以及從需求分析、倉庫理解到實作、測試與多平台部署的完整開發流程能力。相比一般對話模型,GLM-5.2 更適合需要大上下文、持續規劃與可靠 Agent 執行的工程場景。
最大上下文
1M
最大輸出
131.1K
發布日期
2026年6月13日
DeepSeek
DeepSeek V4 Flash
DeepSeek V4 Flash 保留了 V4 系列的 1M token 長上下文能力,但採用更輕量的 MoE 配置,常见模型卡描述为 284B 總參數、13B 啟用參數。它的重點不是最大推理深度,而是更快推理、更低調用成本和更適合生產環境的吞吐量。对于高頻請求、批次處理和長上下文但不一定需要最高推理强度的任務,Flash 会比 Pro 更合适。
最大上下文
1M
最大輸出
384K
發布日期
2026年4月24日
Anthropic
Claude Opus 5
Claude Opus 5 是 Anthropic 的旗艦模型,專為要求嚴苛的推理、編碼和長期自主任務而設計。它在端到端軟體任務、程式碼審查和錯誤發現、圖表和文件的視覺分析、複雜辦公交付以及協調平行子代理方面尤為出色。該模型在長時間任務中保持強大的指令遵循和工具使用能力,同時在優先考慮延遲和令牌效率的低努力設定下仍然有效。
最大上下文
1M
最大輸出
128K
發布日期
2026年7月24日
Anthropic
Claude Opus 5 Fast
Opus 5 的快速模式變體 - 與常規 Opus 5 相同的效能,但輸出速度更快,價格為常規 Opus 5 的兩倍。 了解更多,請參閱 Anthropic 文件:https://platform.claude.com/docs/en/build-with-claude/fast-mode
最大上下文
1M
最大輸出
128K
發布日期
2026年7月24日
xAI
Grok 4.6
Grok 4.6 是 xAI 的先進推理模型,專為複雜程式設計、長時間執行的代理任務和知識工作而打造。它支援文字和影像輸入,上下文視窗最高可達 50 萬 token,並可設定低/中/高/極高推理強度。藉由函式呼叫、Web 與 X 搜尋、程式碼執行和結構化輸出,Grok 4.6 針對跨程式碼庫分析、持續多步驟工具使用、自我驗證和端到端工程工作流程進行了最佳化。它應被理解為通用推理與代理模型,而不只是與 X 平台相關的聊天機器人。
最大上下文
500K
最大輸出
500K
發布日期
2026年8月12日
Gemini 3.6 Flash
Gemini 3.6 Flash 是來自 Google 的高效模型,適用於編碼、智能代理工作流程以及網頁和應用程式開發。它旨在生成精煉的輸出,減少不必要的編輯和模糊表述,同時降低完成任務所需的 Token 使用量和模型調用次數。
最大上下文
1M
最大輸出
65.5K
發布日期
2026年7月21日
xAI
Grok 4.5
Grok 4.5 是 xAI 針對程式設計、智能體任務與知識工作的推理模型,支援文字和圖像輸入、最高 50 萬 token 上下文,以及低/中/高可配置推理強度。它支援函式呼叫、網頁與 X 搜尋、程式碼執行和結構化輸出,適合長上下文分析、多步驟工具呼叫與端到端工程工作流程;不應僅被定位為與 X 平台關聯的聊天機器人。
最大上下文
500K
最大輸出
500K
發布日期
2026年7月8日
Alibaba
Qwen3.7 Plus
Qwen3.7 Plus 延续 Qwen3.7 面向 Agent 的设计方向,但更偏向性价比。第三方模型卡描述它支援文字和圖片輸入,并强化視覺语言能力,以及 GUI、移动端导航、視覺参考等混合 Agent 任務。它適合需要 Qwen3.7 新一代能力,但不一定需要 Max 档位成本的場景。
最大上下文
1M
最大輸出
64K
發布日期
2026年6月2日
OpenAI
GPT-4.1
GPT-4.1 是 OpenAI 強調程式碼、指令遵循和長上下文能力提升的一代模型。官方發布信息将它描述为在许多编程和指令密集型任務上强于 GPT-4o 的開發者模型。它的描述应突出程式碼可靠性和長上下文理解。
最大上下文
1M
最大輸出
32.8K
發布日期
2025年4月14日
OpenAI
GPT-4.1 Mini
GPT-4.1 Mini 将 GPT-4.1 系列的程式碼和指令遵循能力,以更快、更低成本的形式提供出来。它適合高頻開發者工具、结构化生成、信息擷取,以及不需要完整大模型能力的產品功能。它的核心差异是保留 4.1 一代任務纪律性的同时提升生產效率。
最大上下文
1M
最大輸出
32.8K
發布日期
2025年4月14日
OpenAI
GPT-4o
GPT-4o 是 OpenAI GPT-4o 一代的多模态旗舰模型,支援文字和圖像輸入,并具备较强的通用智能。官方文件将它描述为適合广泛语言与視覺任務的高智能通用模型。在更看重多模态理解和自然交互,而不是最新推理栈的場景中,它仍然有价值。
最大上下文
128K
最大輸出
16.4K
發布日期
2024年5月13日
OpenAI
GPT-4o Mini
GPT-4o Mini 是 GPT-4o 家族中的快速、低成本小模型。OpenAI 文件将其定位为面向聚焦任務的模型,支援文字和圖像輸入、结构化輸出、微调和蒸馏工作流程。它更適合被介绍为輕量级多模态生產模型,而不是 GPT-4o 的简单缩小版。
最大上下文
128K
最大輸出
16.4K
發布日期
2024年7月18日
從即時目錄中優先查看高關注模型,再進入詳情頁比較上下文、端點和實際價格。
Alibaba
Qwen3.8 Max
Qwen3.8-Max 是一款擁有2.4兆參數的MoE旗艦模型,專為進階推理、程式設計和企業生產力而設計。它能自主執行複雜的長期任務——從軟體開發到專業工作流程——在法律、金融和設計等領域提供生產級成果。憑藉原生多模態智能,Qwen3.8-Max 能理解長上下文中的文字、圖像和影片,支援對大量文件和長篇內容的深度分析。其智慧體能力支援在複雜工作流程中自主規劃、執行、驗證和持續迭代。
最大上下文
1M
輸入價格
$2 / 百萬 Token
查看模型
Moonshot
Kimi K3
Kimi K3 是一款高效能 AI 模型,專為進階推理、程式編碼及複雜任務執行而設計。它在大規模程式開發專案、多步驟問題解決和知識密集型應用中展現卓越效能。具備廣泛的上下文處理能力和多模態功能,K3 適合打造強大的 AI 代理、開發人員工具和企業級應用。
最大上下文
1M
輸入價格
$2.8571 / 百萬 Token
查看模型
OpenAI
GPT-5.6 Sol
GPT-5.6 Sol 是 Sol 系列的標準版本,適合一般問答、文本處理、內容草擬、摘要生成、輕量程式碼輔助與業務自動化任務。 Sol 專為需要紮實通用能力、同時兼顧回應效率與成本的場景設計,可用於產品功能、聊天助理、內容生成工具、資料清理、知識庫問答及批次處理任務。針對大規模使用或快速原型開發,Sol 是一個靈活的起點。
最大上下文
1.1M
輸入價格
$5 / 百萬 Token
查看模型
OpenAI
GPT-5.6 Sol Pro
GPT-5.6 Sol Pro 是 Sol 系列的專業版,專為複雜任務和更高品質輸出而設計。適用於高階寫作、精準問答、商業推理、程式碼生成、結構化分析及多輪任務執行。 Sol Pro 特別適合需要更強準確性、上下文理解與指令完成度的任務,可用於專業內容製作、資料分析助手、知識問答系統、複雜代理工作流程,以及企業內部 AI 工具。
最大上下文
1.1M
輸入價格
$5 / 百萬 Token
查看模型
OpenAI
GPT-5.6 Terra
GPT-5.6 Terra 是 Terra 系列的通用版本,適用於日常對話、文本生成、摘要、資訊提取、輕量推理和程式碼輔助。 Terra 在泛用能力、回應效率與成本之間取得了實用的平衡。可用於聊天助理、內容工具、辦公室自動化、知識庫問答及批次文本處理工作流程。對於快速迭代或成本敏感的應用,Terra 是 Terra 系列中的理想預設選項。
最大上下文
1.1M
輸入價格
$2.5 / 百萬 Token
查看模型
OpenAI
GPT-5.6 Terra Pro
GPT-5.6 Terra Pro 是 Terra 系列的增強版本,專為複雜任務中的高品質輸出而設計。適用於進階問答、深度內容創作、商業分析、程式碼輔助和多步驟推理。與標準版相比,Terra Pro 更適合需要更高可靠性、更完整推理和更好指令遵循的場景。適合專業寫作、複雜資訊整合、知識型助手、自動化代理和企業級 AI 應用。
最大上下文
1.1M
輸入價格
$2.5 / 百萬 Token
查看模型
與選定的相鄰目錄模型快速比較。
快速了解如何在 TokenHub 目錄中選擇、比較和使用模型。
先看你的具體任務。可以按供應商、標籤、端點類型和計費分組篩選,再比較上下文長度、最大輸出、模態能力以及輸入或輸出價格。
實際價格會把目前計費分組倍率套用到模型價格資料上,幫助你估算所使用分組下真實的輸入、輸出或按次呼叫成本。
可以進入模型詳情頁查看支援的端點類型和文件連結。可用性會因模型、供應商和目前路由配置而不同。
上下文窗口決定模型能讀取多少提示詞和對話歷史;最大輸出決定單次回應能生成多少內容,對長文寫作、程式碼和文件任務尤其重要。