OpenAI
GPT-6.1 Sol
最大コンテキスト
1.1M
最大出力
128K
リリース日
N/A
gpt-4oGPT-4o は、参照元で強調されている特徴として マルチモーダル GPT-4o flagship, text/image input and broad general intelligence を持ちます。主な価値は 視覚言語アプリ, 自然な対話 and general assistant tasks にあります。そのため、汎用チャットモデルとしてではなく、このモデル固有の強みを中心に説明するのが自然です。
Context Window
128K tokens
Maximum Output
16.4K tokens
Release Date
2024年5月13日
Modalities
| 入力価格 | 出力価格 | キャッシュ読み取り |
|---|---|---|
| $2.5/M | $10/M | $1.25/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
GPT-4oは、テキスト生成、画像理解、応答性を組み合わせ、多様な作業に対応する汎用モデルです。
単一の汎用モデルで、幅広い分野の執筆、説明、分析、コーディングを処理します。
文章による指示とともに、写真、グラフ、スクリーンショット、文書ページを解釈します。
モデルの能力と速度を両立し、複数の一般的なタスクを扱う対話型アプリに適しています。
GPT-4oは、マルチモーダルアシスタント、視覚文書分析、対話型のコンテンツ・コーディング支援に適しています。
テキストと画像を組み合わせた質問に答え、ユーザーが視覚情報について自然言語で対話できるようにします。
文書ページ、表、グラフを分析し、情報を抽出して傾向を説明し、簡潔な要約を作成します。
応答性の高い複数ターンの対話を通じて、文章やコードの作成、修正、説明を支援します。
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| 指数スコア | ||
|---|---|---|
| Artificial Analysis Intelligence Index | 総合能力の集約評価 | 9.6 |
| Artificial Analysis Coding Index | コーディング能力の集約評価 | 16.6 |
| 知識と推論 | ||
| GPQA | 高度な科学問題の解決 | 52.1% |
| HLE | 幅広い分野の専門家レベル試験 | 2.9% |
| コーディングとソフトウェア開発 | ||
| LiveCodeBench | 最新のコーディング問題 | 31.7% |
| SciCode | 科学計算のコーディング課題 | 33.1% |
| Terminal-Bench Hard | 高難度のターミナル操作 | 8.3% |
| 数学 | ||
| MATH-500 | 高度な数学問題の解決 | 79.5% |
| AIME | 数学競技形式の問題 | 11.7% |
| 指示追従とエージェントタスク | ||
| IFBench | プロンプト制約への準拠 | 36.0% |
| AA-LCR | 長いコンテキストでの推論 | 35% |
| τ²-Bench | エージェントのワークフロータスク | 28.9% |
指標の出典 Artificial Analysis
GPT-4o の位置づけ、適した用途、主な強み、注意点、TokenHub で安全に利用するための確認事項を紹介します。
GPT-4o は、汎用テキスト処理と画像理解に対応する OpenAI の旧世代 Omni モデルで、現在は従来型の API 選択肢です。ChatGPT では提供終了していますが、API では利用できる場合があります。TokenHub の最新表示を確認してください。
テキストと画像入力の分析、応答性の高い対話アシスタント、および汎用コンテンツ生成に適しています。本番導入前に代表的な入力でテストし、測定可能な合格基準を定めてください。
実用上の主な強みはテキストと画像を組み合わせた理解、幅広い汎用能力、および応答性の高い対話です。この組み合わせは、応答性の高い対話アシスタントで特に価値があります。
新規開発で提供元の現行推奨世代を使うべき場合、専用の推論モデルが必要な場合、または重要な判断に人手レビューを入れられない場合は、別のモデルも検討してください。事実、法務、財務、医療、運用に関わる重要な出力は、適切な専門知識を持つ人が確認してください。
TokenHub では、GPT-4o に表示される正確なモデル識別子を選び、アカウント資料に記載されたエンドポイントと TokenHub 認証情報を使用してください。プラットフォーム上の提供範囲は提供元の全機能と異なる場合があるため、TokenHub の最新資料でテキスト・画像入力の対応状況を確認してください。
1つの API キーで GPT-4o とその他の AI モデルにアクセスできます。
メディアと議論
このモデルに関連する公開動画と投稿を選んでいます。
X (Twitter)
Reddit
YouTube