OpenAI
GPT-6.1 Sol
最大上下文
1.1M
最大輸出
128K
發布日期
暫無
o3-minio3 Mini 是 OpenAI o 系列推理模型中的高性價比版本。發布資料重點強調科学、数学和程式碼等 STEM 任務,同时相对大型推理模型具有更低延遲和成本。它適合需要推理能力,但不能承受完整 o 系列模型时间或成本的場景。
上下文視窗
200K Token
最大輸出
100K Token
發布日期
2024年12月20日
模態
| 輸入價格 | 輸出價格 | 快取讀取 |
|---|---|---|
| $1.1/M | $4.4/M | $0.55/M |
推理
工具呼叫
Temperature 參數
附件
知識庫
Endpoint 協議
o3-mini 為目標明確的分析任務提供精簡型文字推論、長內容脈絡處理及結構化任務執行能力。
以較小模型提供推論能力,適合需要一定分析深度且重視延遲與成本的任務。
支援 200,000 token 的內容脈絡視窗,可分析長文字、程式碼及結構化紀錄。
可將分析結果整理成一致的資料結構,方便下游系統可靠處理文字任務。
o3-mini 適合政策分析、文字轉 SQL 及結構化實體擷取等純文字推論任務。
閱讀長篇政策或規則,依據明確條件評估具體情況並說明判斷結果。
將分析問題與資料庫結構轉換成 SQL 查詢,並說明查詢邏輯以便審查。
辨識大型文字集合中的實體及其關聯,產出適合寫入圖譜或資料庫的紀錄。
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| 指數分數 | ||
|---|---|---|
| Artificial Analysis 綜合能力指數 | Artificial Analysis 綜合能力評分 | 18.4 |
| Artificial Analysis 程式碼能力指數 | Artificial Analysis 軟體任務評分 | 17.3 |
| 知識與推理 | ||
| MMLU-Pro | 高難度多任務知識評測 | 80.2% |
| GPQA | 高階科學問題求解 | 77.3% |
| HLE | 廣泛專家級考試集合 | 12.3% |
| 程式碼與工程 | ||
| LiveCodeBench | 近期程式題評測 | 73.4% |
| SciCode | 科學計算程式碼挑戰 | 39.8% |
| Terminal-Bench Hard | 高難度終端任務執行 | 6.1% |
| 數學能力 | ||
| MATH-500 | 高難度數學解題 | 98.5% |
| AIME | 數學競賽題 | 86% |
| 指令遵循與 Agent 任務 | ||
| IFBench | 指令約束遵循 | 67.1% |
| AA-LCR | 長上下文推理 | 39.3% |
| τ²-Bench | Agent 工作流程任務 | 31.3% |
指標來源 Artificial Analysis
o3 Mini 的能力、適用情境、限制與 TokenHub 使用指南。
o3 Mini 是 OpenAI 針對具成本效益的 STEM 與程式推理推出的模型。
適合數學推理、科學推理、程式碼推理,尤其適合重視回應速度與成本效益的情境。
核心優勢是小型純文字模型中的強大 STEM 與程式推理。
它已停用或被後續模型取代,不適合作為新整合的預設選擇。 新整合優先用 GPT-5.4 Mini。
請確認是否可用;新整合應使用目前建議模型。
透過一個 API Key 接入 o3-mini 與更多 AI 模型。
媒體與討論
精選與此模型相關的公開影片和貼文。
X (Twitter)
Reddit
YouTube