o3-mini

o3-mini

o3 Mini 是 OpenAI o 系列推理模型中的高性價比版本。發布資料重點強調科学、数学和程式碼等 STEM 任務,同时相对大型推理模型具有更低延遲和成本。它適合需要推理能力,但不能承受完整 o 系列模型时间或成本的場景。

上下文視窗

200K Token

最大輸出

100K Token

發布日期

2024年12月20日

模態

o3-mini 價格

輸入價格輸出價格快取讀取
$1.1/M$4.4/M$0.55/M

o3-mini API 能力

推理

支援

工具呼叫

支援

Temperature 參數

不支援

附件

不支援

知識庫

2024-05-01

Endpoint 協議

Completions APIMessages APIgemini

o3-mini 模型亮點

o3-mini 為目標明確的分析任務提供精簡型文字推論、長內容脈絡處理及結構化任務執行能力。

精簡型推論

以較小模型提供推論能力,適合需要一定分析深度且重視延遲與成本的任務。

長文字內容脈絡

支援 200,000 token 的內容脈絡視窗,可分析長文字、程式碼及結構化紀錄。

結構化輸出控制

可將分析結果整理成一致的資料結構,方便下游系統可靠處理文字任務。

o3-mini 使用情境

o3-mini 適合政策分析、文字轉 SQL 及結構化實體擷取等純文字推論任務。

政策與規則分析

閱讀長篇政策或規則,依據明確條件評估具體情況並說明判斷結果。

文字轉 SQL

將分析問題與資料庫結構轉換成 SQL 查詢,並說明查詢邏輯以便審查。

實體關係擷取

辨識大型文字集合中的實體及其關聯,產出適合寫入圖譜或資料庫的紀錄。

如何透過 TokenHub API 使用 o3-mini

建立 API key
import OpenAI from "openai"

const client = new OpenAI({
  apiKey: process.env.TOKENHUB_API_KEY,
  baseURL: "https://us-api.tokenhub.com/v1",
})

const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)

o3-mini 基準測試

指數分數
Artificial Analysis 綜合能力指數Artificial Analysis 綜合能力評分18.4
Artificial Analysis 程式碼能力指數Artificial Analysis 軟體任務評分17.3
知識與推理
MMLU-Pro高難度多任務知識評測80.2%
GPQA高階科學問題求解77.3%
HLE廣泛專家級考試集合12.3%
程式碼與工程
LiveCodeBench近期程式題評測73.4%
SciCode科學計算程式碼挑戰39.8%
Terminal-Bench Hard高難度終端任務執行6.1%
數學能力
MATH-500高難度數學解題98.5%
AIME數學競賽題86%
指令遵循與 Agent 任務
IFBench指令約束遵循67.1%
AA-LCR長上下文推理39.3%
τ²-BenchAgent 工作流程任務31.3%

指標來源 Artificial Analysis

媒體與討論

精選與此模型相關的公開影片和貼文。

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

o3 Mini 常見問題

o3 Mini 的能力、適用情境、限制與 TokenHub 使用指南。

團隊該如何理解 o3 Mini?+

o3 Mini 是 OpenAI 針對具成本效益的 STEM 與程式推理推出的模型。

o3 Mini 最適合做什麼?+

適合數學推理、科學推理、程式碼推理,尤其適合重視回應速度與成本效益的情境。

o3 Mini 的主要優勢是什麼?+

核心優勢是小型純文字模型中的強大 STEM 與程式推理。

o3 Mini 總是最佳選擇嗎?+

它已停用或被後續模型取代,不適合作為新整合的預設選擇。 新整合優先用 GPT-5.4 Mini。

最穩妥的設定方式是什麼?+

請確認是否可用;新整合應使用目前建議模型。

準備呼叫 o3-mini?

透過一個 API Key 接入 o3-mini 與更多 AI 模型。

建立 API Key