모델 허브

하나의 프로덕션 카탈로그에서 AI 모델 가격, 기능, 엔드포인트, 공급업체 범위를 확인하세요.

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max는 고급 추론, 코딩 및 엔터프라이즈 생산성을 위해 설계된 2.4T 파라미터 MoE 플래그십 모델입니다. 소프트웨어 개발부터 전문 워크플로우까지 복잡하고 오래 지속되는 작업을 자율적으로 실행하며 법률, 금융, 디자인 등 다양한 분야에서 프로덕션급 결과를 제공합니다. 네이티브 멀티모달 인텔리전스로 구동되는 Qwen3.8-Max는 긴 컨텍스트에서 텍스트, 이미지, 비디오를 이해하고 광범위한 문서와 장문 콘텐츠의 심층 분석을 지원합니다. 에이전트 기능은 복잡한 워크플로우 전반에 걸쳐 자율적인 계획, 실행, 검증 및 지속적인 반복을 가능하게 합니다.

최대 컨텍스트

1M

최대 출력

128K

출시일

2026년 8월 3일

입력$2 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.25 / 백만 토큰

Moonshot

Kimi K3

kimi-k3

Kimi K3는 고급 추론, 코딩, 복잡한 작업 실행을 위해 설계된 고성능 AI 모델입니다. 대규모 프로그래밍 프로젝트, 다단계 문제 해결, 지식 집약적 애플리케이션에서 뛰어난 성능을 제공합니다. 광범위한 컨텍스트 처리와 멀티모달 기능을 갖춘 K3는 강력한 AI 에이전트, 개발자 도구, 엔터프라이즈급 애플리케이션을 구축하는 데 적합합니다.

최대 컨텍스트

1M

최대 출력

131.1K

출시일

2026년 7월 16일

입력$2.8571 / 백만 토큰
출력$14.2857 / 백만 토큰
캐시 읽기$0.2857 / 백만 토큰

OpenAI

GPT-5.6 Sol

gpt-5.6-sol

GPT-5.6 Sol은 Sol 시리즈의 표준 버전으로, 일반 Q&A, 텍스트 처리, 콘텐츠 초안 작성, 요약, 가벼운 코딩 지원 및 비즈니스 자동화 작업에 적합합니다. Sol은 탄탄한 범용 성능을 유지하면서 응답 효율성과 비용을 고려해야 하는 시나리오를 위해 설계되었습니다. 제품 기능, 채팅 도우미, 콘텐츠 생성 도구, 데이터 정제, 지식 기반 Q&A, 배치 처리 작업에 사용할 수 있습니다. 대규모 사용이나 빠른 프로토타이핑을 위한 유연한 출발점입니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$5 / 백만 토큰
출력$30 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰

OpenAI

GPT-5.6 Sol Pro

gpt-5.6-sol-pro

GPT-5.6 Sol Pro는 Sol 시리즈의 Pro 버전으로, 복잡한 작업과 고품질 출력을 위해 설계되었습니다. 고급 글쓰기, 정밀한 Q&A, 비즈니스 추론, 코드 생성, 구조화된 분석 및 다중 턴 작업 실행에 적합합니다. Sol Pro는 더 높은 정확성, 문맥 이해, 지시 완료가 요구되는 작업에 적합하며, 전문 콘텐츠 제작, 데이터 분석 어시스턴트, 지식 Q&A 시스템, 복잡한 에이전트 워크플로우, 기업 내부 AI 도구로 사용할 수 있습니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$5 / 백만 토큰
출력$30 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰

OpenAI

GPT-5.6 Terra

gpt-5.6-terra

GPT-5.6 Terra는 Terra 시리즈의 범용 버전으로, 일상 대화, 텍스트 생성, 요약, 정보 추출, 경량 추론 및 코딩 지원에 적합합니다. Terra는 범용 성능, 응답 효율성, 비용 간의 실용적인 균형을 제공합니다. 채팅 도우미, 콘텐츠 도구, 사무 자동화, 지식 베이스 Q&A, 배치 텍스트 처리 워크플로에 사용할 수 있습니다. 빠른 반복 작업이나 비용에 민감한 애플리케이션에 Terra 시리즈 중에서 Terra를 강력한 기본 옵션으로 선택할 수 있습니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$2.5 / 백만 토큰
출력$15 / 백만 토큰
캐시 읽기$0.275 / 백만 토큰

OpenAI

GPT-5.6 Terra Pro

gpt-5.6-terra-pro

GPT-5.6 Terra Pro는 Terra 시리즈의 향상된 버전으로, 복잡한 작업에서 고품질 출력을 제공하도록 설계되었습니다. 고급 Q&A, 심층 콘텐츠 제작, 비즈니스 분석, 코딩 지원, 다단계 추론에 적합합니다. 표준 버전과 비교하여 더 높은 신뢰성, 완전한 추론, 우수한 명령 이행이 필요한 시나리오에 더 적합합니다. 전문 작문, 복잡한 정보 통합, 지식 기반 어시스턴트, 자동화 에이전트, 엔터프라이즈급 AI 애플리케이션에 적합합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$2.5 / 백만 토큰
출력$15 / 백만 토큰
캐시 읽기$0.275 / 백만 토큰

OpenAI

GPT-5.6 Luna

gpt-5.6-luna

GPT-5.6 Luna는 Luna 시리즈의 범용 버전으로, 일상적인 AI 애플리케이션에 적합합니다. 채팅 Q&A, 텍스트 재작성, 요약, 정보 추출, 간단한 추론, 코딩 지원, 사무 자동화에 사용할 수 있습니다. Luna는 프로토타입, 경량 비즈니스 기능, 배치 콘텐츠 처리, 일반적인 사용자 상호작용 시나리오에 실용적인 선택입니다. 속도, 단순성, 비용 관리가 중요할 때 좋은 시작 모델이며, 더 높은 품질이나 안정적인 출력이 필요한 작업에는 Luna Pro를 고려할 수 있습니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$1 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰

OpenAI

GPT-5.6 Luna Pro

gpt-5.6-luna-pro

GPT-5.6 Luna Pro는 Luna 시리즈의 향상된 버전으로, 더 높은 품질의 답변, 더 안정적인 명령 수행, 더 강력한 작업 완료를 목표로 합니다. 복잡한 대화, 콘텐츠 생성, 지식 Q&A, 비즈니스 분석, 코딩 지원, 다단계 자동화 작업에 적합합니다. Luna Pro는 전문 글쓰기 도우미, 기업 AI 어시스턴트, 고객 지원, 지식 베이스 시스템, 에이전트 워크플로우 등 출력 품질과 사용자 경험이 중요한 제품 환경에 매우 적합합니다. 표준 Luna 모델보다 더 높은 신뢰성이 필요한 작업에 좋은 선택입니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 7월 9일

입력$1 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰

DeepSeek

DeepSeek V4 Pro

deepseek-v4-pro

DeepSeek V4 Pro은(는) 출처에서 MoE 1.6T 총 / 49B 활성, 1M-token 컨텍스트, hybrid 긴 컨텍스트 attention을(를) 핵심 특징으로 제시합니다. 주요 가치는 고급 추론, 코딩, 전체 코드베이스 분석 and 장기 에이전트 워크플로에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

384K

출시일

2026년 4월 24일

입력$1.2857 / 백만 토큰
출력$3.8571 / 백만 토큰
캐시 읽기$0.0429 / 백만 토큰

Z.ai

GLM-5.2

glm-5.2

GLM-5.2는 장기 엔지니어링 작업을 위한 Z.ai의 플래그십 기반 모델입니다. 실제로 활용 가능한 1M 토큰 컨텍스트 창을 강조하며, 프로젝트 규모의 코드, 문서, 시스템 맥락을 함께 처리할 수 있습니다. 요구사항 분석, 저장소 이해, 구현, 테스트, 멀티플랫폼 배포까지 이어지는 전체 개발 워크플로에 적합합니다.

최대 컨텍스트

1M

최대 출력

131.1K

출시일

2026년 6월 13일

입력$1.1429 / 백만 토큰
출력$4 / 백만 토큰
캐시 읽기$0.2857 / 백만 토큰

DeepSeek

DeepSeek V4 Flash

deepseek-v4-flash

DeepSeek V4 Flash은(는) 출처에서 MoE 284B 총 / 13B 활성, 1M-token 컨텍스트, 처리량 중심 추론을(를) 핵심 특징으로 제시합니다. 주요 가치는 대량 프로덕션 호출, 빠른 긴 컨텍스트 처리 and 비용 민감형 자동화에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

384K

출시일

2026년 4월 24일

입력$0.4286 / 백만 토큰
출력$1.2857 / 백만 토큰
캐시 읽기$0.0143 / 백만 토큰

Anthropic

Claude Opus 5

claude-opus-5

Claude Opus 5는 Anthropic의 플래그십 모델로, 까다로운 추론, 코딩, 장기 에이전트 작업을 위해 설계되었습니다. 종단 간 소프트웨어 작업, 코드 리뷰 및 버그 발견, 차트 및 문서의 시각적 분석, 복잡한 사무 작업, 병렬 하위 에이전트 조정에 특히 뛰어납니다. 이 모델은 확장된 작업에서 강력한 명령 수행 및 도구 사용을 유지하면서도 지연 시간과 토큰 효율성을 우선시하는 낮은 노력 설정에서도 효과적입니다.

최대 컨텍스트

1M

최대 출력

128K

출시일

2026년 7월 24일

입력$5 / 백만 토큰
출력$25 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰

Anthropic

Claude Opus 5 Fast

claude-opus-5-fast

Opus 5의 고속 모드 변형 - 일반 Opus 5와 동일한 성능, 더 빠른 출력 속도, 일반 Opus 5 대비 2배 가격. 자세한 내용은 Anthropic 문서 참조: https://platform.claude.com/docs/en/build-with-claude/fast-mode

최대 컨텍스트

1M

최대 출력

128K

출시일

2026년 7월 24일

입력$10 / 백만 토큰
출력$50 / 백만 토큰
캐시 읽기$1 / 백만 토큰

xAI

Grok 4.6

grok-4.6

Grok 4.6은 xAI의 고급 추론 모델로, 복잡한 프로그래밍, 장기 실행 에이전트 작업, 지식 작업을 위해 설계되었습니다. 텍스트 및 이미지 입력을 지원하며 최대 50만 토큰의 컨텍스트 창과 낮음/중간/높음/매우 높음 추론 강도를 구성할 수 있습니다. 함수 호출, 웹·X 검색, 코드 실행, 구조화된 출력을 갖춘 Grok 4.6은 여러 코드베이스 분석, 지속적인 다단계 도구 사용, 자체 검증, 엔드투엔드 엔지니어링 워크플로우에 최적화되어 있습니다. 이는 단순히 X 플랫폼과 연결된 챗봇이 아니라 범용 추론 및 에이전트 모델로 이해해야 합니다.

최대 컨텍스트

500K

최대 출력

500K

출시일

2026년 8월 12일

입력$2 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.3 / 백만 토큰

Google

Gemini 3.6 Flash

gemini-3.6-flash

Gemini 3.6 Flash는 코딩, 에이전트 워크플로, 웹 및 앱 개발을 위한 Google의 고효율 모델입니다. 불필요한 편집과 모호한 표현을 줄여 정제된 출력을 생성하도록 설계되었으며, 작업 완료에 필요한 토큰 사용량과 모델 호출 횟수를 감소시킵니다.

최대 컨텍스트

1M

최대 출력

65.5K

출시일

2026년 7월 21일

입력$1.5 / 백만 토큰
출력$7.5 / 백만 토큰
캐시 읽기$0.15 / 백만 토큰

xAI

Grok 4.5

grok-4.5

Grok 4.5는 프로그래밍, 에이전트 작업 및 지식 작업을 위한 xAI의 추론 모델입니다. 텍스트 및 이미지 입력, 최대 50만 토큰 컨텍스트, 낮음/중간/높음 구성 가능한 추론 강도를 지원합니다. 함수 호출, 웹 및 X 검색, 코드 실행, 구조화된 출력을 지원하며, 긴 컨텍스트 분석, 다단계 도구 호출 및 엔드투엔드 엔지니어링 워크플로에 적합합니다. X 플랫폼에 연결된 단순한 챗봇으로만 간주되어서는 안 됩니다.

최대 컨텍스트

500K

최대 출력

500K

출시일

2026년 7월 8일

입력$2 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.3 / 백만 토큰

Alibaba

Qwen3.7 Plus

qwen3.7-plus

Qwen3.7 Plus은(는) 출처에서 text+image input, vision-language upgrade, hybrid agent capability을(를) 핵심 특징으로 제시합니다. 주요 가치는 GUI 작업, 모바일 내비게이션, 시각 참조 워크플로 and 비용 효율적 Qwen3.7 use에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

64K

출시일

2026년 6월 2일

입력$0.2857 / 백만 토큰
출력$1.1429 / 백만 토큰
캐시 읽기$0.0571 / 백만 토큰

OpenAI

GPT-4.1

gpt-4.1

GPT-4.1은(는) 출처에서 improved 코딩, instruction following and long 컨텍스트 versus earlier GPT-4 generation을(를) 핵심 특징으로 제시합니다. 주요 가치는 개발자 도구, 프로그래밍 지원 and instruction-heavy tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

32.8K

출시일

2025년 4월 14일

입력$2 / 백만 토큰
출력$8 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰

OpenAI

GPT-4.1 Mini

gpt-4.1-mini

GPT-4.1 Mini은(는) 출처에서 빠른er/lower-cost GPT-4.1 variant을(를) 핵심 특징으로 제시합니다. 주요 가치는 대량 developer features, 구조화 generation and 추출에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

1M

최대 출력

32.8K

출시일

2025년 4월 14일

입력$0.4 / 백만 토큰
출력$1.6 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰

OpenAI

GPT-4o

gpt-4o

GPT-4o은(는) 출처에서 멀티모달 GPT-4o flagship, text/image input and broad general intelligence을(를) 핵심 특징으로 제시합니다. 주요 가치는 vision-language applications, 자연스러운 상호작용 and general assistant tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

128K

최대 출력

16.4K

출시일

2024년 5월 13일

입력$2.5 / 백만 토큰
출력$10 / 백만 토큰
캐시 읽기$1.25 / 백만 토큰

OpenAI

GPT-4o Mini

gpt-4o-mini

GPT-4o Mini은(는) 출처에서 small affordable GPT-4o model with text/image input and 구조화 output support을(를) 핵심 특징으로 제시합니다. 주요 가치는 lightweight 멀티모달 production, 파인튜닝, 증류 and focused tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.

최대 컨텍스트

128K

최대 출력

16.4K

출시일

2024년 7월 18일

입력$0.15 / 백만 토큰
출력$0.6 / 백만 토큰
캐시 읽기$0.075 / 백만 토큰

인기 모델 추천

라이브 카탈로그에서 주목도가 높은 모델부터 살펴보고, 상세 페이지에서 컨텍스트, 엔드포인트, 실제 가격을 비교하세요.

Alibaba

Qwen3.8 Max

Qwen3.8-Max는 고급 추론, 코딩 및 엔터프라이즈 생산성을 위해 설계된 2.4T 파라미터 MoE 플래그십 모델입니다. 소프트웨어 개발부터 전문 워크플로우까지 복잡하고 오래 지속되는 작업을 자율적으로 실행하며 법률, 금융, 디자인 등 다양한 분야에서 프로덕션급 결과를 제공합니다. 네이티브 멀티모달 인텔리전스로 구동되는 Qwen3.8-Max는 긴 컨텍스트에서 텍스트, 이미지, 비디오를 이해하고 광범위한 문서와 장문 콘텐츠의 심층 분석을 지원합니다. 에이전트 기능은 복잡한 워크플로우 전반에 걸쳐 자율적인 계획, 실행, 검증 및 지속적인 반복을 가능하게 합니다.

최대 컨텍스트

1M

입력 가격

$2 / 백만 토큰

모델 보기

Moonshot

Kimi K3

Kimi K3는 고급 추론, 코딩, 복잡한 작업 실행을 위해 설계된 고성능 AI 모델입니다. 대규모 프로그래밍 프로젝트, 다단계 문제 해결, 지식 집약적 애플리케이션에서 뛰어난 성능을 제공합니다. 광범위한 컨텍스트 처리와 멀티모달 기능을 갖춘 K3는 강력한 AI 에이전트, 개발자 도구, 엔터프라이즈급 애플리케이션을 구축하는 데 적합합니다.

최대 컨텍스트

1M

입력 가격

$2.8571 / 백만 토큰

모델 보기

OpenAI

GPT-5.6 Sol

GPT-5.6 Sol은 Sol 시리즈의 표준 버전으로, 일반 Q&A, 텍스트 처리, 콘텐츠 초안 작성, 요약, 가벼운 코딩 지원 및 비즈니스 자동화 작업에 적합합니다. Sol은 탄탄한 범용 성능을 유지하면서 응답 효율성과 비용을 고려해야 하는 시나리오를 위해 설계되었습니다. 제품 기능, 채팅 도우미, 콘텐츠 생성 도구, 데이터 정제, 지식 기반 Q&A, 배치 처리 작업에 사용할 수 있습니다. 대규모 사용이나 빠른 프로토타이핑을 위한 유연한 출발점입니다.

최대 컨텍스트

1.1M

입력 가격

$5 / 백만 토큰

모델 보기

OpenAI

GPT-5.6 Sol Pro

GPT-5.6 Sol Pro는 Sol 시리즈의 Pro 버전으로, 복잡한 작업과 고품질 출력을 위해 설계되었습니다. 고급 글쓰기, 정밀한 Q&A, 비즈니스 추론, 코드 생성, 구조화된 분석 및 다중 턴 작업 실행에 적합합니다. Sol Pro는 더 높은 정확성, 문맥 이해, 지시 완료가 요구되는 작업에 적합하며, 전문 콘텐츠 제작, 데이터 분석 어시스턴트, 지식 Q&A 시스템, 복잡한 에이전트 워크플로우, 기업 내부 AI 도구로 사용할 수 있습니다.

최대 컨텍스트

1.1M

입력 가격

$5 / 백만 토큰

모델 보기

OpenAI

GPT-5.6 Terra

GPT-5.6 Terra는 Terra 시리즈의 범용 버전으로, 일상 대화, 텍스트 생성, 요약, 정보 추출, 경량 추론 및 코딩 지원에 적합합니다. Terra는 범용 성능, 응답 효율성, 비용 간의 실용적인 균형을 제공합니다. 채팅 도우미, 콘텐츠 도구, 사무 자동화, 지식 베이스 Q&A, 배치 텍스트 처리 워크플로에 사용할 수 있습니다. 빠른 반복 작업이나 비용에 민감한 애플리케이션에 Terra 시리즈 중에서 Terra를 강력한 기본 옵션으로 선택할 수 있습니다.

최대 컨텍스트

1.1M

입력 가격

$2.5 / 백만 토큰

모델 보기

OpenAI

GPT-5.6 Terra Pro

GPT-5.6 Terra Pro는 Terra 시리즈의 향상된 버전으로, 복잡한 작업에서 고품질 출력을 제공하도록 설계되었습니다. 고급 Q&A, 심층 콘텐츠 제작, 비즈니스 분석, 코딩 지원, 다단계 추론에 적합합니다. 표준 버전과 비교하여 더 높은 신뢰성, 완전한 추론, 우수한 명령 이행이 필요한 시나리오에 더 적합합니다. 전문 작문, 복잡한 정보 통합, 지식 기반 어시스턴트, 자동화 에이전트, 엔터프라이즈급 AI 애플리케이션에 적합합니다.

최대 컨텍스트

1.1M

입력 가격

$2.5 / 백만 토큰

모델 보기

모델 비교

선택한 인접 카탈로그 모델과 빠르게 비교합니다.

모델 카탈로그 FAQ

TokenHub 카탈로그에서 모델을 선택하고 비교하며 사용하는 방법을 빠르게 확인하세요.

이 목록에서 모델을 어떻게 선택해야 하나요?

+

먼저 작업 유형을 정하세요. 제공업체, 태그, 엔드포인트 유형, 과금 그룹으로 좁힌 뒤 컨텍스트 길이, 최대 출력, 모달리티, 입력 또는 출력 가격을 비교하세요.

실제 가격은 무엇을 의미하나요?

+

실제 가격은 활성 과금 그룹 비율을 모델 가격 데이터에 적용한 값입니다. 사용하는 그룹에서 입력, 출력 또는 요청당 비용을 추정하는 데 도움이 됩니다.

이 모델들을 API 엔드포인트로 사용할 수 있나요?

+

네. 모델 상세 페이지에서 지원되는 엔드포인트 유형과 문서 링크를 확인할 수 있습니다. 사용 가능 여부는 모델, 제공업체, 현재 라우팅 설정에 따라 달라질 수 있습니다.

컨텍스트 윈도우와 최대 출력은 왜 중요한가요?

+

컨텍스트 윈도우는 모델이 읽을 수 있는 프롬프트와 대화 기록의 양을 정합니다. 최대 출력은 한 번의 응답에서 생성할 수 있는 양을 정하며 긴 글, 코딩, 문서 작업에 중요합니다.