OpenAI
GPT-6.1 Sol
최대 컨텍스트
1.1M
최대 출력
128K
출시일
N/A
gpt-4oGPT-4o은(는) 출처에서 멀티모달 GPT-4o flagship, text/image input and broad general intelligence을(를) 핵심 특징으로 제시합니다. 주요 가치는 vision-language applications, 자연스러운 상호작용 and general assistant tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.
Context Window
128K tokens
Maximum Output
16.4K tokens
Release Date
2024년 5월 13일
Modalities
| 입력 가격 | 출력 가격 | 캐시 읽기 |
|---|---|---|
| $2.5/M | $10/M | $1.25/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
GPT-4o는 텍스트 생성, 이미지 이해, 빠른 응답을 결합해 다양한 작업을 처리하는 범용 모델입니다.
하나의 범용 모델로 다양한 분야의 작성, 설명, 분석, 코딩 작업을 처리합니다.
텍스트 지침과 함께 사진, 차트, 스크린샷, 문서 페이지를 해석합니다.
모델 역량과 속도의 균형을 유지해 여러 일반 작업을 다루는 대화형 애플리케이션에 적합합니다.
GPT-4o는 멀티모달 도우미, 시각 문서 분석, 대화형 콘텐츠 및 코딩 지원에 적합합니다.
텍스트와 이미지가 결합된 질문에 답해 사용자가 보이는 내용을 자연어로 논의할 수 있게 합니다.
문서 페이지, 표, 차트를 분석해 정보를 추출하고 패턴을 설명하며 간결한 요약을 작성합니다.
반응성 높은 다중 대화를 통해 텍스트나 코드 콘텐츠의 작성, 수정, 설명을 지원합니다.
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| 지표 점수 | ||
|---|---|---|
| Artificial Analysis Intelligence Index | 종합 역량 평가 | 9.6 |
| Artificial Analysis Coding Index | 코딩 역량 종합 평가 | 16.6 |
| 지식 및 추론 | ||
| GPQA | 고난도 과학 문제 해결 | 52.1% |
| HLE | 다분야 전문가 수준 평가 | 2.9% |
| 코딩 및 소프트웨어 엔지니어링 | ||
| LiveCodeBench | 최신 코딩 문제 | 31.7% |
| SciCode | 과학 컴퓨팅 코딩 과제 | 33.1% |
| Terminal-Bench Hard | 고난도 터미널 작업 수행 | 8.3% |
| 수학 | ||
| MATH-500 | 고난도 수학 문제 해결 | 79.5% |
| AIME | 수학 경시대회 형식 문제 | 11.7% |
| 지시 준수 및 에이전트 작업 | ||
| IFBench | 프롬프트 제약 준수 | 36.0% |
| AA-LCR | 긴 컨텍스트 추론 | 35% |
| τ²-Bench | 에이전트 워크플로 작업 | 28.9% |
지표 출처 Artificial Analysis
GPT-4o의 포지션, 적합한 용도, 주요 강점, 고려할 제한 사항과 TokenHub 연동 시 확인할 내용을 알아보세요.
GPT-4o 모델은 일반 텍스트와 시각 이해를 지원하는 OpenAI의 이전 세대 Omni 모델로, 현재는 구형 API 선택지입니다. ChatGPT에서는 종료되었지만 API에서는 제공될 수 있으므로 TokenHub의 현재 목록을 확인하세요.
텍스트와 이미지 입력 분석, 반응성 높은 대화형 어시스턴트, 그리고 범용 콘텐츠 생성에 적합합니다. 프로덕션 적용 전에 대표 입력으로 테스트하고 측정 가능한 승인 기준을 정하세요.
가장 실용적인 강점은 텍스트와 이미지를 함께 이해하는 능력, 폭넓은 범용 성능, 그리고 반응성 높은 대화 성능입니다. 이 조합은 반응성 높은 대화형 어시스턴트에 특히 유용합니다.
신규 개발에서 공급자의 최신 권장 세대를 사용해야 하는 경우, 전용 추론 모델이 필요한 경우, 또는 중요한 의사결정에 사람의 검토를 넣을 수 없는 경우에는 다른 모델을 고려하세요. 사실, 법률, 재무, 의료, 운영과 관련된 중요한 출력은 자격을 갖춘 사람이 검토해야 합니다.
TokenHub에서는 GPT-4o에 표시된 정확한 모델 식별자를 선택하고 계정 문서의 엔드포인트와 TokenHub 자격 증명을 사용하세요. 플랫폼 제공 범위가 공급자의 전체 기능과 다를 수 있으므로 TokenHub 최신 문서에서 텍스트·이미지 입력 지원 여부를 확인하세요.
하나의 API 키로 GPT-4o과 더 많은 AI 모델을 이용하세요.
미디어 및 논의
이 모델과 관련된 공개 동영상과 게시물을 선별했습니다.
X (Twitter)
Reddit
YouTube