OpenAI
GPT-6.1 Sol
最大上下文
1.1M
最大输出
128K
发布日期
暂无
gpt-4oGPT-4o 是 OpenAI GPT-4o 一代的多模态旗舰模型,支持文本和图像输入,并具备较强的通用智能。官方文档将它描述为适合广泛语言与视觉任务的高智能通用模型。在更看重多模态理解和自然交互,而不是最新推理栈的场景中,它仍然有价值。
上下文窗口
128K Token
最大输出
16.4K Token
发布日期
2024年5月13日
模态
| 输入价格 | 输出价格 | 缓存读取 |
|---|---|---|
| $2.5/M | $10/M | $1.25/M |
推理
工具调用
Temperature 参数
附件
知识库
Endpoint 协议
GPT-4o 是一款通用模型,结合文本生成、图像理解和及时响应能力,可处理多种工作负载。
在单一通用模型中处理多个领域的写作、解释、分析和编程任务。
结合文字指令解读照片、图表、截图和文档页面。
在模型能力与速度之间取得平衡,适合覆盖多种常见任务的交互式应用。
GPT-4o 适合多模态助手、视觉文档分析以及交互式内容和编程辅助。
回答与图文输入相关的问题,使用户能够用自然语言讨论可见内容。
分析文档页面、表格和图表,提取信息、解释规律并生成简洁摘要。
通过及时的多轮对话帮助用户起草、修改和解释文字或代码内容。
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| 指数分数 | ||
|---|---|---|
| Artificial Analysis 综合能力指数 | Artificial Analysis 综合能力评分 | 9.6 |
| Artificial Analysis 代码能力指数 | Artificial Analysis 软件任务评分 | 16.6 |
| 知识与推理 | ||
| GPQA | 高阶科学问题求解 | 52.1% |
| HLE | 广泛专家级考试集合 | 2.9% |
| 代码与工程 | ||
| LiveCodeBench | 近期编程题评测 | 31.7% |
| SciCode | 科学计算代码挑战 | 33.1% |
| Terminal-Bench Hard | 高难度终端任务执行 | 8.3% |
| 数学能力 | ||
| MATH-500 | 高难度数学解题 | 79.5% |
| AIME | 数学竞赛题 | 11.7% |
| 指令遵循与 Agent 任务 | ||
| IFBench | 指令约束遵循 | 36.0% |
| AA-LCR | 长上下文推理 | 35% |
| τ²-Bench | Agent 工作流任务 | 28.9% |
指标来源 Artificial Analysis
了解 GPT-4o 的定位、适合处理的任务、主要优势、使用限制,以及在 TokenHub 中接入时需要注意的事项。
GPT-4o 是 OpenAI 较早一代的 Omni 模型,可处理通用文本和视觉理解任务,目前属于较旧的 API 选项。它已从 ChatGPT 下线,但 API 可能仍可用;请以 TokenHub 当前页面为准。
它适合文本与图像输入分析、响应及时的交互式助手以及通用内容生成。上线前应使用有代表性的输入进行测试,并制定可衡量的验收标准。
它最实用的优势包括结合文本与图像的理解能力、广泛的通用能力以及响应自然的对话表现。这些特点对响应及时的交互式助手尤其有价值。
如果新项目应采用提供商当前推荐的新一代模型、任务需要专门的推理模型,或重要决策流程无法安排人工复核,可以考虑其他模型。涉及事实、法律、财务、医疗或运营的重要结果,应由具备相关资质的人员复核。
在 TokenHub 中,请选择页面显示的 GPT-4o 精确模型标识,使用账号文档中指定的接口,并通过 TokenHub 凭证完成认证。请查看 TokenHub 当前文档中的文本与图像输入支持情况,因为平台开放能力可能与提供商完整能力不同。
通过一个 API Key 接入 GPT-4o 与更多 AI 模型。
媒体与讨论
精选与此模型相关的公开视频和帖子。
X (Twitter)
Reddit
YouTube