o4-mini

o4-mini

o4 Mini 是更小的推理模型,针对数学、程式碼和視覺任務中的速度与成本效率进行优化。OpenAI 發布資料強調它可以在推理过程中使用工具,因此能力不局限于纯文字回答。它適合被描述為面向生產负载的紧凑型推理与工具模型。

上下文視窗

200K Token

最大輸出

100K Token

發布日期

2025年4月16日

模態

o4-mini 價格

輸入價格輸出價格快取讀取
$0.15/M$0.6/M$0.075/M

o4-mini API 能力

推理

支援

工具呼叫

支援

Temperature 參數

不支援

附件

支援

知識庫

2024-05-01

Endpoint 協議

geminiCompletions APIMessages API

o4-mini 模型亮點

o4-mini 結合快速推論、高效率程式開發與視覺分析能力,適合目標明確的技術任務。

快速推論

以小型模型進行有效推論,同時兼顧實用的回應速度與處理成本。

高效率程式開發

將推論用於程式碼生成、診斷及修改,著重高效率完成技術任務。

視覺任務推論

結合文字與圖像輸入進行推論,解讀圖表、螢幕截圖及視覺問題描述。

o4-mini 使用情境

o4-mini 適合程式碼問題調查、視覺技術問答,以及重視效率的大批量推論任務。

程式碼問題調查

分析程式碼與錯誤資訊、辨識可能原因,並提出方便開發者審查的針對性修正。

圖表技術問答

解讀圖表與相關文字,說明元件、關係及技術問題的解決思路。

批次推論任務

批次處理需要推論、無法僅靠簡單分類完成的技術或分析問題。

如何透過 TokenHub API 使用 o4-mini

建立 API key

執行前請替換這些路徑參數: {model}

curl 'https://us-api.tokenhub.com/v1beta/models/{model}:generateContent' \
  -X 'POST' \
  -H "Authorization: Bearer $TOKENHUB_API_KEY"

o4-mini 基準測試

o4-mini (high)

指數分數
Artificial Analysis 綜合能力指數Artificial Analysis 綜合能力評分25.6
Artificial Analysis 程式碼能力指數Artificial Analysis 軟體任務評分25.6
Artificial Analysis 數學能力指數Artificial Analysis 數學推理評分90.7
知識與推理
MMLU-Pro高難度多任務知識評測83.2%
GPQA高階科學問題求解78.4%
HLE廣泛專家級考試集合17.5%
程式碼與工程
LiveCodeBench近期程式題評測85.9%
SciCode科學計算程式碼挑戰46.5%
Terminal-Bench Hard高難度終端任務執行15.2%
數學能力
MATH-500高難度數學解題98.9%
AIME數學競賽題94%
AIME 2025數學競賽題90.7%
指令遵循與 Agent 任務
IFBench指令約束遵循68.7%
AA-LCR長上下文推理55.0%
τ²-BenchAgent 工作流程任務55.6%

指標來源 Artificial Analysis

媒體與討論

精選與此模型相關的公開影片和貼文。

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

o4 Mini 常見問題

o4 Mini 的能力、適用情境、限制與 TokenHub 使用指南。

o4 Mini 主要解決什麼問題?+

o4 Mini 是 OpenAI 針對快速且具成本效益的數學、程式與視覺推理推出的模型。

什麼時候適合選 o4 Mini?+

適合數學推理、複雜程式開發、視覺推理,尤其適合重視回應速度與成本效益的情境。

o4 Mini 擅長什麼?+

核心優勢是快速且具成本效益的推理,尤其擅長程式與視覺任務。

o4 Mini 犧牲了什麼?+

它已停用或被後續模型取代,不適合作為新整合的預設選擇。 新整合優先用 GPT-5.4 Mini。

如何在 TokenHub 中呼叫 o4 Mini?+

請確認是否可用;新整合應使用目前建議模型。

準備呼叫 o4-mini?

透過一個 API Key 接入 o4-mini 與更多 AI 模型。

建立 API Key