모델 허브

하나의 프로덕션 카탈로그에서 AI 모델 가격, 기능, 엔드포인트, 공급업체 범위를 확인하세요.

Moonshot

Kimi K3

kimi-k3

Kimi K3는 고급 추론, 코딩, 복잡한 작업 실행을 위해 설계된 고성능 AI 모델입니다. 대규모 프로그래밍 프로젝트, 다단계 문제 해결, 지식 집약적 애플리케이션에서 뛰어난 성능을 제공합니다. 광범위한 컨텍스트 처리와 멀티모달 기능을 갖춘 K3는 강력한 AI 에이전트, 개발자 도구, 엔터프라이즈급 애플리케이션을 구축하는 데 적합합니다.

최대 컨텍스트

1M

최대 출력

131.1K

출시일

2026년 7월 16일

입력$2.8571 / 백만 토큰
출력$14.2857 / 백만 토큰
캐시 읽기$0.2857 / 백만 토큰

OpenAI

GPT-5.5

gpt-5.5

GPT-5.5은(는) 출처에서 frontier OpenAI model, stronger 코딩/연구/데이터 분석 profile을(를) 핵심 특징으로 제시합니다. 주요 가치는 broad professional intelligence and 구조화 지식 업무에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 4월 23일

입력$5 / 백만 토큰
출력$30 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰

DeepSeek

DeepSeek V4 Pro

deepseek-v4-pro

DeepSeek V4 Pro은(는) 출처에서 MoE 1.6T 총 / 49B 활성, 1M-token 컨텍스트, hybrid 긴 컨텍스트 attention을(를) 핵심 특징으로 제시합니다. 주요 가치는 고급 추론, 코딩, 전체 코드베이스 분석 and 장기 에이전트 워크플로에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

384K

출시일

2026년 4월 24일

입력$1.8 / 백만 토큰
출력$3.5 / 백만 토큰
캐시 읽기$0.015 / 백만 토큰

DeepSeek

DeepSeek V4 Flash

deepseek-v4-flash

DeepSeek V4 Flash은(는) 출처에서 MoE 284B 총 / 13B 활성, 1M-token 컨텍스트, 처리량 중심 추론을(를) 핵심 특징으로 제시합니다. 주요 가치는 대량 프로덕션 호출, 빠른 긴 컨텍스트 처리 and 비용 민감형 자동화에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

384K

출시일

2026년 4월 24일

입력$0.15 / 백만 토큰
출력$0.3 / 백만 토큰
캐시 읽기$0.003 / 백만 토큰

Alibaba

Qwen3.7 Plus

qwen3.7-plus

Qwen3.7 Plus은(는) 출처에서 text+image input, vision-language upgrade, hybrid agent capability을(를) 핵심 특징으로 제시합니다. 주요 가치는 GUI 작업, 모바일 내비게이션, 시각 참조 워크플로 and 비용 효율적 Qwen3.7 use에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

64K

출시일

2026년 6월 2일

입력$0.2857 / 백만 토큰
출력$1.1429 / 백만 토큰
캐시 읽기$0.0571 / 백만 토큰

OpenAI

GPT-4.1

gpt-4.1

GPT-4.1은(는) 출처에서 improved 코딩, instruction following and long 컨텍스트 versus earlier GPT-4 generation을(를) 핵심 특징으로 제시합니다. 주요 가치는 개발자 도구, 프로그래밍 지원 and instruction-heavy tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

32.8K

출시일

2025년 4월 14일

입력$2 / 백만 토큰
출력$8 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰

OpenAI

GPT-4.1 Mini

gpt-4.1-mini

GPT-4.1 Mini은(는) 출처에서 빠른er/lower-cost GPT-4.1 variant을(를) 핵심 특징으로 제시합니다. 주요 가치는 대량 developer features, 구조화 generation and 추출에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

32.8K

출시일

2025년 4월 14일

입력$0.4 / 백만 토큰
출력$1.6 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰

OpenAI

GPT-4o

gpt-4o

GPT-4o은(는) 출처에서 멀티모달 GPT-4o flagship, text/image input and broad general intelligence을(를) 핵심 특징으로 제시합니다. 주요 가치는 vision-language applications, 자연스러운 상호작용 and general assistant tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

128K

최대 출력

16.4K

출시일

2024년 5월 13일

입력$2.5 / 백만 토큰
출력$10 / 백만 토큰
캐시 읽기$1.25 / 백만 토큰

OpenAI

GPT-4o Mini

gpt-4o-mini

GPT-4o Mini은(는) 출처에서 small affordable GPT-4o model with text/image input and 구조화 output support을(를) 핵심 특징으로 제시합니다. 주요 가치는 lightweight 멀티모달 production, 파인튜닝, 증류 and focused tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

128K

최대 출력

16.4K

출시일

2024년 7월 18일

입력$0.15 / 백만 토큰
출력$0.6 / 백만 토큰
캐시 읽기$0.075 / 백만 토큰

OpenAI

GPT-5.3 Chat

gpt-5.3-chat

gpt-5.3-chat은 GPT-5.3 Instant의 API용 이름으로, 일상 대화를 더 매끄럽고 직접적이며 유용하게 만들기 위한 ChatGPT 스냅샷입니다. OpenAI는 답변 정확도, 웹 검색 맥락화, 대화 흐름을 개선하고 불필요한 단서, 우회 표현, 과도하게 조심스러운 문구를 줄였다고 설명합니다. 다만 공식 API 문서에서는 더 최신 GPT 모델 사용을 권장하며 deprecated로 표시되어 있습니다.

최대 컨텍스트

128K

최대 출력

16.4K

출시일

2026년 3월 3일

입력$1.75 / 백만 토큰
출력$14 / 백만 토큰
캐시 읽기$0.175 / 백만 토큰

OpenAI

GPT-5.3 Codex

gpt-5.3-codex

gpt-5.3-codex는 Codex 및 유사한 개발 환경을 위한 OpenAI의 에이전트 코딩 모델입니다. 프런티어급 소프트웨어 엔지니어링 성능과 더 넓은 추론 및 전문 지식을 결합하며, 조정 가능한 reasoning effort, 400K 컨텍스트, 128K 최대 출력을 지원합니다. 단순 코드 작성과 리뷰를 넘어 컴퓨터 사용, 터미널 워크플로, 장기 엔지니어링 작업을 수행하는 모델로 포지셔닝됩니다.

최대 컨텍스트

400K

최대 출력

128K

출시일

2026년 2월 5일

입력$1.75 / 백만 토큰
출력$14 / 백만 토큰
캐시 읽기$0.175 / 백만 토큰

OpenAI

GPT-5.4

gpt-5.4

GPT-5.4은(는) 출처에서 frontier work model, native computer use, 문서/스프레드시트/프레젠테이션, large 컨텍스트을(를) 핵심 특징으로 제시합니다. 주요 가치는 professional productivity, 코딩, 사실 기반 분석 and real work execution에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 3월 5일

입력$2.5 / 백만 토큰
출력$15 / 백만 토큰
캐시 읽기$0.25 / 백만 토큰

OpenAI

GPT-5.4 Mini

gpt-5.4-mini

GPT-5.4 Mini은(는) 출처에서 smaller/빠른er GPT-5.4 variant with 도구 사용 and 멀티모달 추론을(를) 핵심 특징으로 제시합니다. 주요 가치는 저지연 production tasks, 서브 에이전트 and well-scoped 코딩 워크플로에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

400K

최대 출력

128K

출시일

2026년 3월 17일

입력$0.75 / 백만 토큰
출력$4.5 / 백만 토큰
캐시 읽기$0.075 / 백만 토큰

OpenAI

GPT-5.4 Nano

gpt-5.4-nano

GPT-5.4 Nano은(는) 출처에서 smallest/lowest-cost GPT-5.4 option을(를) 핵심 특징으로 제시합니다. 주요 가치는 분류, 라우팅, 추출 and predictable 대량 generation에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

400K

최대 출력

128K

출시일

2026년 3월 17일

입력$0.2 / 백만 토큰
출력$1.25 / 백만 토큰
캐시 읽기$0.02 / 백만 토큰

OpenAI

GPT-5.4 Pro

gpt-5.4-pro

GPT-5.4 Pro은(는) 출처에서 higher-precision GPT-5.4 tier을(를) 핵심 특징으로 제시합니다. 주요 가치는 demanding 분석, complex code and high-stakes professional outputs에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 3월 5일

입력$30 / 백만 토큰
출력$180 / 백만 토큰

OpenAI

GPT-5.5 Pro

gpt-5.5-pro

GPT-5.5 Pro은(는) 출처에서 higher-compute GPT-5.5 tier, precision-first 추론을(를) 핵심 특징으로 제시합니다. 주요 가치는 difficult 전문 업무, 코딩, 연구, 데이터 분석 and 문서 중심 tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 4월 23일

입력$30 / 백만 토큰
출력$180 / 백만 토큰

OpenAI

GPT-5.6 Luna

gpt-5.6-luna

GPT-5.6 Luna는 Luna 시리즈의 범용 버전으로, 일상적인 AI 애플리케이션에 적합합니다. 채팅 Q&A, 텍스트 재작성, 요약, 정보 추출, 간단한 추론, 코딩 지원, 사무 자동화에 사용할 수 있습니다. Luna는 프로토타입, 경량 비즈니스 기능, 배치 콘텐츠 처리, 일반적인 사용자 상호작용 시나리오에 실용적인 선택입니다. 속도, 단순성, 비용 관리가 중요할 때 좋은 시작 모델이며, 더 높은 품질이나 안정적인 출력이 필요한 작업에는 Luna Pro를 고려할 수 있습니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$1 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰

OpenAI

GPT-5.6 Luna Pro

gpt-5.6-luna-pro

GPT-5.6 Luna Pro는 Luna 시리즈의 향상된 버전으로, 더 높은 품질의 답변, 더 안정적인 명령 수행, 더 강력한 작업 완료를 목표로 합니다. 복잡한 대화, 콘텐츠 생성, 지식 Q&A, 비즈니스 분석, 코딩 지원, 다단계 자동화 작업에 적합합니다. Luna Pro는 전문 글쓰기 도우미, 기업 AI 어시스턴트, 고객 지원, 지식 베이스 시스템, 에이전트 워크플로우 등 출력 품질과 사용자 경험이 중요한 제품 환경에 매우 적합합니다. 표준 Luna 모델보다 더 높은 신뢰성이 필요한 작업에 좋은 선택입니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$1 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰

OpenAI

GPT-5.6 Sol

gpt-5.6-sol

GPT-5.6 Sol은 Sol 시리즈의 표준 버전으로, 일반 Q&A, 텍스트 처리, 콘텐츠 초안 작성, 요약, 가벼운 코딩 지원 및 비즈니스 자동화 작업에 적합합니다. Sol은 탄탄한 범용 성능을 유지하면서 응답 효율성과 비용을 고려해야 하는 시나리오를 위해 설계되었습니다. 제품 기능, 채팅 도우미, 콘텐츠 생성 도구, 데이터 정제, 지식 기반 Q&A, 배치 처리 작업에 사용할 수 있습니다. 대규모 사용이나 빠른 프로토타이핑을 위한 유연한 출발점입니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$5 / 백만 토큰
출력$30 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰

OpenAI

GPT-5.6 Sol Pro

gpt-5.6-sol-pro

GPT-5.6 Sol Pro는 Sol 시리즈의 Pro 버전으로, 복잡한 작업과 고품질 출력을 위해 설계되었습니다. 고급 글쓰기, 정밀한 Q&A, 비즈니스 추론, 코드 생성, 구조화된 분석 및 다중 턴 작업 실행에 적합합니다. Sol Pro는 더 높은 정확성, 문맥 이해, 지시 완료가 요구되는 작업에 적합하며, 전문 콘텐츠 제작, 데이터 분석 어시스턴트, 지식 Q&A 시스템, 복잡한 에이전트 워크플로우, 기업 내부 AI 도구로 사용할 수 있습니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$5 / 백만 토큰
출력$30 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰

OpenAI

GPT-5.6 Terra

gpt-5.6-terra

GPT-5.6 Terra는 Terra 시리즈의 범용 버전으로, 일상 대화, 텍스트 생성, 요약, 정보 추출, 경량 추론 및 코딩 지원에 적합합니다. Terra는 범용 성능, 응답 효율성, 비용 간의 실용적인 균형을 제공합니다. 채팅 도우미, 콘텐츠 도구, 사무 자동화, 지식 베이스 Q&A, 배치 텍스트 처리 워크플로에 사용할 수 있습니다. 빠른 반복 작업이나 비용에 민감한 애플리케이션에 Terra 시리즈 중에서 Terra를 강력한 기본 옵션으로 선택할 수 있습니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$2.5 / 백만 토큰
출력$15 / 백만 토큰
캐시 읽기$0.275 / 백만 토큰

인기 모델 추천

라이브 카탈로그에서 주목도가 높은 모델부터 살펴보고, 상세 페이지에서 컨텍스트, 엔드포인트, 실제 가격을 비교하세요.

Moonshot

Kimi K3

Kimi K3는 고급 추론, 코딩, 복잡한 작업 실행을 위해 설계된 고성능 AI 모델입니다. 대규모 프로그래밍 프로젝트, 다단계 문제 해결, 지식 집약적 애플리케이션에서 뛰어난 성능을 제공합니다. 광범위한 컨텍스트 처리와 멀티모달 기능을 갖춘 K3는 강력한 AI 에이전트, 개발자 도구, 엔터프라이즈급 애플리케이션을 구축하는 데 적합합니다.

최대 컨텍스트

1M

입력 가격

$2.8571 / 백만 토큰

모델 보기

OpenAI

GPT-5.5

GPT-5.5은(는) 출처에서 frontier OpenAI model, stronger 코딩/연구/데이터 분석 profile을(를) 핵심 특징으로 제시합니다. 주요 가치는 broad professional intelligence and 구조화 지식 업무에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1.1M

입력 가격

$5 / 백만 토큰

모델 보기

DeepSeek

DeepSeek V4 Pro

DeepSeek V4 Pro은(는) 출처에서 MoE 1.6T 총 / 49B 활성, 1M-token 컨텍스트, hybrid 긴 컨텍스트 attention을(를) 핵심 특징으로 제시합니다. 주요 가치는 고급 추론, 코딩, 전체 코드베이스 분석 and 장기 에이전트 워크플로에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

입력 가격

$1.8 / 백만 토큰

모델 보기

DeepSeek

DeepSeek V4 Flash

DeepSeek V4 Flash은(는) 출처에서 MoE 284B 총 / 13B 활성, 1M-token 컨텍스트, 처리량 중심 추론을(를) 핵심 특징으로 제시합니다. 주요 가치는 대량 프로덕션 호출, 빠른 긴 컨텍스트 처리 and 비용 민감형 자동화에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

입력 가격

$0.15 / 백만 토큰

모델 보기

Alibaba

Qwen3.7 Plus

Qwen3.7 Plus은(는) 출처에서 text+image input, vision-language upgrade, hybrid agent capability을(를) 핵심 특징으로 제시합니다. 주요 가치는 GUI 작업, 모바일 내비게이션, 시각 참조 워크플로 and 비용 효율적 Qwen3.7 use에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

입력 가격

$0.2857 / 백만 토큰

모델 보기

OpenAI

GPT-4.1

GPT-4.1은(는) 출처에서 improved 코딩, instruction following and long 컨텍스트 versus earlier GPT-4 generation을(를) 핵심 특징으로 제시합니다. 주요 가치는 개발자 도구, 프로그래밍 지원 and instruction-heavy tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

입력 가격

$2 / 백만 토큰

모델 보기

모델 비교

선택한 인접 카탈로그 모델과 빠르게 비교합니다.

모델 카탈로그 FAQ

TokenHub 카탈로그에서 모델을 선택하고 비교하며 사용하는 방법을 빠르게 확인하세요.

이 목록에서 모델을 어떻게 선택해야 하나요?

+

먼저 작업 유형을 정하세요. 제공업체, 태그, 엔드포인트 유형, 과금 그룹으로 좁힌 뒤 컨텍스트 길이, 최대 출력, 모달리티, 입력 또는 출력 가격을 비교하세요.

실제 가격은 무엇을 의미하나요?

+

실제 가격은 활성 과금 그룹 비율을 모델 가격 데이터에 적용한 값입니다. 사용하는 그룹에서 입력, 출력 또는 요청당 비용을 추정하는 데 도움이 됩니다.

이 모델들을 API 엔드포인트로 사용할 수 있나요?

+

네. 모델 상세 페이지에서 지원되는 엔드포인트 유형과 문서 링크를 확인할 수 있습니다. 사용 가능 여부는 모델, 제공업체, 현재 라우팅 설정에 따라 달라질 수 있습니다.

컨텍스트 윈도우와 최대 출력은 왜 중요한가요?

+

컨텍스트 윈도우는 모델이 읽을 수 있는 프롬프트와 대화 기록의 양을 정합니다. 최대 출력은 한 번의 응답에서 생성할 수 있는 양을 정하며 긴 글, 코딩, 문서 작업에 중요합니다.