GPT-4o

gpt-4o

GPT-4o は、参照元で強調されている特徴として マルチモーダル GPT-4o flagship, text/image input and broad general intelligence を持ちます。主な価値は 視覚言語アプリ, 自然な対話 and general assistant tasks にあります。そのため、汎用チャットモデルとしてではなく、このモデル固有の強みを中心に説明するのが自然です。

Context Window

128K tokens

Maximum Output

16.4K tokens

Release Date

2024年5月13日

Modalities

GPT-4o の料金

入力価格出力価格キャッシュ読み取り
$2.5/M$10/M$1.25/M

GPT-4o の API 機能

Reasoning

Not supported

Tool calling

Supported

Temperature parameter

Supported

Attachments

Supported

Knowledge Base

2023-09-01

Endpoint Protocols

Completions APIMessages APIgemini

GPT-4oのモデル特長

GPT-4oは、テキスト生成、画像理解、応答性を組み合わせ、多様な作業に対応する汎用モデルです。

汎用的な言語能力

単一の汎用モデルで、幅広い分野の執筆、説明、分析、コーディングを処理します。

画像理解

文章による指示とともに、写真、グラフ、スクリーンショット、文書ページを解釈します。

応答性の高い汎用処理

モデルの能力と速度を両立し、複数の一般的なタスクを扱う対話型アプリに適しています。

GPT-4oのユースケース

GPT-4oは、マルチモーダルアシスタント、視覚文書分析、対話型のコンテンツ・コーディング支援に適しています。

マルチモーダル支援

テキストと画像を組み合わせた質問に答え、ユーザーが視覚情報について自然言語で対話できるようにします。

視覚文書分析

文書ページ、表、グラフを分析し、情報を抽出して傾向を説明し、簡潔な要約を作成します。

対話型コンテンツ支援

応答性の高い複数ターンの対話を通じて、文章やコードの作成、修正、説明を支援します。

TokenHub API で GPT-4o を使用する方法

Create API key
import OpenAI from "openai"

const client = new OpenAI({
  apiKey: process.env.TOKENHUB_API_KEY,
  baseURL: "https://us-api.tokenhub.com/v1",
})

const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)

GPT-4o のベンチマーク

指数スコア
Artificial Analysis Intelligence Index総合能力の集約評価9.6
Artificial Analysis Coding Indexコーディング能力の集約評価16.6
知識と推論
GPQA高度な科学問題の解決52.1%
HLE幅広い分野の専門家レベル試験2.9%
コーディングとソフトウェア開発
LiveCodeBench最新のコーディング問題31.7%
SciCode科学計算のコーディング課題33.1%
Terminal-Bench Hard高難度のターミナル操作8.3%
数学
MATH-500高度な数学問題の解決79.5%
AIME数学競技形式の問題11.7%
指示追従とエージェントタスク
IFBenchプロンプト制約への準拠36.0%
AA-LCR長いコンテキストでの推論35%
τ²-Benchエージェントのワークフロータスク28.9%

指標の出典 Artificial Analysis

メディアと議論

このモデルに関連する公開動画と投稿を選んでいます。

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

GPT-4o に関するよくある質問

GPT-4o の位置づけ、適した用途、主な強み、注意点、TokenHub で安全に利用するための確認事項を紹介します。

GPT-4o はどの種類のモデルですか?+

GPT-4o は、汎用テキスト処理と画像理解に対応する OpenAI の旧世代 Omni モデルで、現在は従来型の API 選択肢です。ChatGPT では提供終了していますが、API では利用できる場合があります。TokenHub の最新表示を確認してください。

チームは GPT-4o を何に使うとよいですか?+

テキストと画像入力の分析、応答性の高い対話アシスタント、および汎用コンテンツ生成に適しています。本番導入前に代表的な入力でテストし、測定可能な合格基準を定めてください。

GPT-4o が明確な技術的優位性を持つのはどこですか?+

実用上の主な強みはテキストと画像を組み合わせた理解、幅広い汎用能力、および応答性の高い対話です。この組み合わせは、応答性の高い対話アシスタントで特に価値があります。

GPT-4o ではなく別のモデルを選ぶべきなのはどのような場合ですか?+

新規開発で提供元の現行推奨世代を使うべき場合、専用の推論モデルが必要な場合、または重要な判断に人手レビューを入れられない場合は、別のモデルも検討してください。事実、法務、財務、医療、運用に関わる重要な出力は、適切な専門知識を持つ人が確認してください。

GPT-4o を TokenHub と連携する前に何を確認すべきですか?+

TokenHub では、GPT-4o に表示される正確なモデル識別子を選び、アカウント資料に記載されたエンドポイントと TokenHub 認証情報を使用してください。プラットフォーム上の提供範囲は提供元の全機能と異なる場合があるため、TokenHub の最新資料でテキスト・画像入力の対応状況を確認してください。

GPT-4o を使い始めますか?

1つの API キーで GPT-4o とその他の AI モデルにアクセスできます。

API キーを作成