모델 허브

하나의 프로덕션 카탈로그에서 AI 모델 가격, 기능, 엔드포인트, 공급업체 범위를 확인하세요.

OpenAI

GPT-6.1 Sol

gpt-6.1-sol

GPT-6.1 Sol은 복잡한 문제 해결, 코딩 및 에이전트 기반 애플리케이션을 위해 구축된 고급 추론 모델입니다. 지능, 속도, 비용 간의 실용적인 균형을 유지하면서 강력한 추론 성능을 제공하도록 설계되었습니다. 주로 응답 생성에 초점을 맞춘 기존 채팅 모델과 달리, GPT-6.1 Sol은 다단계 추론, 코드 생성, 디버깅, 데이터 분석, 복잡한 지시 따르기 등 더 깊은 사고가 필요한 작업에 최적화되어 있습니다. GPT-6.1 Sol은 신뢰할 수 있는 추론 워크플로, 구조화된 출력, 도구 기반 애플리케이션을 지원하므로 AI 어시스턴트, 코딩 에이전트, 자동화 시스템, 프로덕션 AI 애플리케이션을 구축하는 개발자에게 적합합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 9월 29일

입력$2 / 백만 토큰
출력$10 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰

OpenAI

GPT-6.1 Sol Pro

gpt-6.1-sol-pro

GPT-6.1 Sol Pro는 GPT-6.1 Sol의 향상된 추론 버전입니다. GPT-6.1 Sol과 동일한 기반 모델을 사용하지만 reasoning.mode=pro를 활성화하여 각 요청에 훨씬 더 많은 연산을 투입할 수 있습니다. 추가 추론 예산은 GPT-6.1 Sol Pro가 더 깊은 분석, 더 긴 계획, 더 높은 정확도를 요구하는 어려운 문제를 처리하는 데 도움이 됩니다. 응답 속도나 비용 효율성보다 최상의 답변을 얻는 것이 더 중요한 작업을 위해 설계되었습니다. GPT-6.1 Sol과 비교하여 GPT-6.1 Sol Pro는 요청당 훨씬 더 많은 추론 토큰을 소비하므로 사용 비용이 더 높고 응답 시간이 더 깁니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 9월 29일

입력$2 / 백만 토큰
출력$10 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰

Anthropic

Claude Sonnet 5.5

claude-sonnet-5.5

Claude Sonnet 5.5는 고급 추론, 코딩, 분석, 복잡한 에이전트 워크플로를 위해 설계된 차세대 AI 모델입니다. 소프트웨어 개발, 긴 컨텍스트 이해, 멀티모달 작업, 전문 지식 업무 전반에서 뛰어난 성능을 발휘하며 지능과 속도, 효율의 균형을 제공합니다. 향상된 추론 능력과 개선된 지시 수행 능력을 바탕으로 코드 작성 및 디버깅, 복잡한 문서 분석, 다단계 문제 해결, 신뢰할 수 있는 의사결정과 도구 사용이 필요한 AI 에이전트 구동에 탁월합니다.

최대 컨텍스트

1M

최대 출력

128K

출시일

2026년 9월 28일

입력$2 / 백만 토큰
출력$10 / 백만 토큰
캐시 읽기$0.2 / 백만 토큰

xAI

Grok 4.7

grok-4.7

Grok 4.7은 고난도 코딩 작업, 복잡한 추론, 지식 집약적 애플리케이션을 위해 설계된 xAI의 최신 세대 모델입니다. 장기적인 문제 해결, 자기 검증, 워크플로 실행 능력을 향상시켜 지능형 어시스턴트와 AI 기반 제품을 만드는 개발자에게 적합합니다. Grok 4.7은 프로그래밍, 분석, 범용 AI 작업 전반에서 뛰어난 성능을 제공하면서 프로덕션 배포에 적합한 효율성도 유지합니다.

최대 컨텍스트

500K

최대 출력

500K

출시일

2026년 9월 21일

입력$1.6 / 백만 토큰
출력$4.8 / 백만 토큰
캐시 읽기$0.4 / 백만 토큰

Anthropic

Claude Opus 5.5

claude-opus-5.5

Claude Opus 5.5는 Anthropic의 플래그십 지능 모델로, 깊은 추론과 안정성, 장시간 작업 실행이 필요한 고부하 워크로드를 위해 설계되었습니다. 소프트웨어 엔지니어링, 에이전트 워크플로, 전문 분석, 지식 집약적 작업에서 뛰어난 성능을 발휘합니다. 향상된 효율성과 강화된 안전 장치를 갖춘 Claude Opus 5.5는 복잡한 작업 전반에서 일관된 성능을 요구하는 정교한 AI 애플리케이션을 개발하는 개발자에게 최적화되어 있습니다.

최대 컨텍스트

1M

최대 출력

128K

출시일

2026년 9월 22일

입력$4 / 백만 토큰
출력$20 / 백만 토큰
캐시 읽기$0.2 / 백만 토큰

OpenAI

GPT-6 Sol

gpt-6-sol

GPT-6 Sol은 OpenAI GPT-6 시리즈의 고성능 모델로, 복잡한 추론 작업과 소프트웨어 개발, 전문 AI 워크플로를 위해 설계되었습니다. 다단계 문제 해결, 고급 코딩, 데이터 분석, 에이전트 기반 애플리케이션에서 향상된 지능을 제공합니다. GPT-6 Sol은 강력한 추론 능력과 효율적인 추론 성능을 결합하여, 프로덕션 AI 시스템에 최전선 수준의 성능이 필요한 개발자에게 적합합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 9월 22일

입력$2 / 백만 토큰
출력$10 / 백만 토큰
캐시 읽기$0.2 / 백만 토큰

OpenAI

GPT-6 Sol Pro

gpt-6-sol-pro

GPT-6 Sol Pro는 GPT-6 Sol의 향상된 추론 변형으로, 더 깊은 분석, 높은 정확도, 더 안정적인 다단계 실행이 필요한 작업을 위해 설계되었습니다. 향상된 추론 능력을 바탕으로 GPT-6 Sol Pro는 소프트웨어 엔지니어링, 복잡한 워크플로, 데이터 분석, AI 에이전트 애플리케이션에서 더 강력한 성능을 제공합니다. 어려운 작업에서 일관된 결과가 필요한 고급 AI 시스템을 구축하는 개발자에 최적화되어 있습니다. GPT-6 Sol Pro는 긴 컨텍스트 처리, 도구 호출, 구조화된 출력을 지원하므로 강력한 추론과 자동화 기능이 필요한 프로덕션급 애플리케이션에 적합합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 9월 22일

입력$2 / 백만 토큰
출력$10 / 백만 토큰
캐시 읽기$0.2 / 백만 토큰

OpenAI

GPT-6 Luna

gpt-6-luna

GPT-6 Luna는 OpenAI의 GPT-6 제품군에 속한 컴팩트하고 효율적인 모델로, 크게 향상된 비용 효율성과 강력한 언어 지능을 제공하도록 설계되었습니다. 대화형 AI, 콘텐츠 생성, 코딩 지원, 자동화 워크플로 등 일상적인 AI 애플리케이션에서 안정적인 성능을 제공합니다. 큰 컨텍스트 창과 최적화된 추론 효율성을 갖춘 GPT-6 Luna는 높은 처리량, 낮은 지연 시간, 예측 가능한 운영 비용이 필요한 확장 가능한 AI 제품을 만드는 개발자에게 이상적입니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 9월 22일

입력$0.1 / 백만 토큰
출력$0.5 / 백만 토큰
캐시 읽기$0.01 / 백만 토큰

OpenAI

GPT-6 Luna Pro

gpt-6-luna-pro

GPT-6 Luna Pro는 GPT-6 Luna의 추론에 최적화된 버전으로, Luna 제품군의 효율성과 경제성을 유지하면서 더 강력한 문제 해결 능력을 제공하도록 설계되었습니다. 표준 고속 추론 모델과 비교해 복잡한 지시, 코딩 작업, 분석 워크플로, 경량 에이전트 애플리케이션에서 성능이 향상되었습니다. GPT-6 Luna Pro는 프로덕션 워크로드의 확장성을 유지하면서 더 높은 품질의 응답이 필요한 개발자에게 적합합니다. 긴 컨텍스트 처리, 함수 호출, 구조화된 출력을 지원하여 지능, 속도, 비용 효율성 사이의 균형을 제공합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 9월 22일

입력$0.1 / 백만 토큰
출력$0.5 / 백만 토큰
캐시 읽기$0.01 / 백만 토큰

Alibaba

Qwen3.8 Omni Flash

qwen3.8-omni-flash

Qwen3.8 Omni Flash는 Alibaba의 Qwen 제품군이 선보이는 차세대 옴니모달 모델로, 텍스트, 이미지, 오디오, 비디오를 통합 AI 시스템 안에서 이해하고 처리하도록 설계되었습니다. 강력한 언어 지능과 고급 멀티모달 이해 능력을 결합해 실제 AI 애플리케이션에 활용할 수 있습니다. 최대 100만 토큰의 컨텍스트 윈도우를 지원하며, Qwen3.8 Omni Flash는 장문 문서 분석, 멀티미디어 이해, 에이전트 워크플로에 최적화되어 있습니다. 복잡한 오디오 및 비디오 콘텐츠를 분석하고 여러 모달리티에 걸쳐 추론하며, 지능형 AI 애플리케이션 구축을 위한 도구 호출을 지원합니다. 고효율 배포를 위해 설계된 Qwen3.8 Omni Flash는 멀티모달 지능, 확장성, 비용 효율성 사이에서 뛰어난 균형을 제공하여 차세대 AI 어시스턴트, 콘텐츠 분석 시스템, 자동화 에이전트를 구축하는 개발자에게 적합합니다.

최대 컨텍스트

1M

최대 출력

131.1K

출시일

2026년 9월 17일

입력$0.1143 / 백만 토큰
출력$0.3857 / 백만 토큰
캐시 읽기$0.0143 / 백만 토큰

TypeSafe

Jev 1.13

jev-1.13

Jev 1.13은 TypeSafe AI의 첫 번째 System One 의사 결정 모델로, 텍스트 생성이 아닌 구조화된 AI 판단을 위해 설계되었습니다. 제공된 컨텍스트를 분석하고 구조화된 선택지, 점수, 신뢰도 기반 결정을 반환합니다. 분류, 라우팅, 평가, 자동화 워크플로에 맞게 설계되어 낮은 지연 시간과 효율적인 토큰 사용으로 빠르고 예측 가능한 AI 결정을 제공합니다.

최대 컨텍스트

32K

최대 출력

N/A

출시일

2026년 9월 18일

입력$0.042 / 백만 토큰
출력$0 / 백만 토큰

Z.ai

GLM-5.3-FlashX

glm-5.3-flashx

GLM-5.3-FlashX는 Z.ai의 고속 멀티모달 모델로, GLM-5.3-Flash의 핵심 기능을 유지하면서 빠르고 반응성 높은 추론을 위해 설계되었습니다. 텍스트, 이미지, 비디오, 파일 입력을 지원하며 컨텍스트 창은 최대 100만 토큰입니다. 코딩, 에이전트 워크플로, 시각 이해, 장문맥 작업, 복잡한 추론 전반에서 뛰어난 성능을 발휘하므로 속도와 지능을 모두 요구하는 실시간 AI 애플리케이션에 적합합니다.

최대 컨텍스트

1M

최대 출력

131.1K

출시일

2026년 9월 18일

입력$0.2857 / 백만 토큰
출력$1 / 백만 토큰
캐시 읽기$0.0814 / 백만 토큰

DeepSeek

DeepSeek V4.1 Flash

deepseek-v4.1-flash

DeepSeek-V4.1-Flash는 고급 추론, 코딩 및 에이전트 기능을 갖춘 빠르고 효율적인 멀티모달 AI 모델입니다. 최대 100만 토큰의 컨텍스트와 네이티브 비전 이해를 지원하며, 더 낮은 추론 비용으로 프런티어급 지능을 제공해 AI 에이전트, 자동화, 코딩 어시스턴트, 확장 가능한 애플리케이션에 이상적입니다.

최대 컨텍스트

1M

최대 출력

384K

출시일

2026년 9월 10일

입력$0.2857 / 백만 토큰
출력$1.1429 / 백만 토큰
캐시 읽기$0.0057 / 백만 토큰

OpenAI

GPT-6 Astra

gpt-6-astra

GPT-6 Astra는 OpenAI의 차세대 플래그십 모델로, 복잡한 추론, 소프트웨어 엔지니어링, AI 에이전트, 연구, 그리고 까다로운 엔드투엔드 전문 워크플로를 위해 설계되었습니다. 코드, 브라우저, 전문 소프트웨어를 아우르는 다단계 작업에서 뛰어나며, 문제 해결, 도구 사용, 컴퓨터 사용, 장기 컨텍스트 이해에서 더 강력한 성능을 제공합니다. GPT-6 Astra는 최대 1.05M 토큰의 컨텍스트 창과 최대 128K 토큰의 출력을 지원하며, Low, Medium, High, XHigh, Max 등 여러 추론 노력 수준을 제공하여 개발자가 작업 복잡도에 따라 추론 능력, 효율성, 비용을 조정할 수 있습니다. 고급 AI 에이전트, 복잡한 소프트웨어 개발, 자동화 워크플로, 심층 연구, 장문 문서 처리, 데이터 분석, 엔터프라이즈 AI 애플리케이션에 적합합니다.

최대 컨텍스트

1.1M

최대 출력

128K

출시일

2026년 9월 4일

입력$10 / 백만 토큰
출력$50 / 백만 토큰
캐시 읽기$1 / 백만 토큰

Anthropic

Claude Fable 5.1

claude-fable-5.1

Claude Fable 5는 Anthropic의 Mythos급 모델로, 까다로운 추론, 소프트웨어 엔지니어링, 지식 작업, 시각 분석, 과학 연구를 위해 설계되었습니다. 장기 에이전트 작업을 위해 구축되어 복잡한 워크플로 전반에서 계획과 실행을 유지하고, 대규모 코드베이스와 문서를 분석하며, 여러 단계에 걸쳐 작업을 개선할 수 있습니다. Claude Fable 5는 고급 코딩, 리서치, 전문 분석, 그리고 안정적인 자율 작업 완료를 요구하는 프로덕션 애플리케이션에 매우 적합합니다.

최대 컨텍스트

1M

최대 출력

128K

출시일

2026년 9월 1일

입력$10 / 백만 토큰
출력$50 / 백만 토큰
캐시 읽기$0.25 / 백만 토큰

Z.ai

GLM-5.3-Flash

glm-5.3-flash

GLM-5.3-Flash는 GLM-5 제품군에서 Z.ai가 처음 선보이는 네이티브 멀티모달 모델로, 빠른 코딩, 시각적 이해, 에이전트 워크플로를 위해 설계되었습니다. 320B 파라미터 MoE 아키텍처는 토큰당 18B 파라미터를 활성화하고 스파스 어텐션과 리니어 어텐션을 결합하여 긴 컨텍스트 작업을 더 효율적으로 처리합니다. 프로덕션 코딩이나 멀티모달 에이전트 작업에 배포하기 전에 TokenHub를 통해 GLM API를 사용하여 현재 GLM-5.3-Flash의 가격, 모델 ID, 지원되는 입력, 도구 호출, 컨텍스트 제한 및 엔드포인트를 평가하세요.

최대 컨텍스트

1M

최대 출력

131.1K

출시일

2026년 8월 26일

입력$0.1143 / 백만 토큰
출력$0.4 / 백만 토큰
캐시 읽기$0.0329 / 백만 토큰

Z.ai

GLM-5.3

glm-5.3

GLM-5.3은 Z.ai의 최신 플래그십 모델로, 고급 코딩, 소프트웨어 엔지니어링, 장기 에이전트 작업을 위해 설계되었습니다. 1M 토큰 컨텍스트 창, 최대 128K 출력 토큰, 강력한 추론 및 도구 사용 기능을 갖추고 있어 코딩 에이전트, 복잡한 개발 워크플로우, 다단계 자동화에 이상적입니다.

최대 컨텍스트

1M

최대 출력

128K

출시일

2026년 8월 19일

입력$1.1429 / 백만 토큰
출력$4 / 백만 토큰
캐시 읽기$0.2857 / 백만 토큰

Tencent

Hy4 preview

hy4-preview

Hy4 preview는 Tencent Hunyuan의 차세대 오픈소스 MoE 플래그십 모델로, 코딩, 오피스 작업, 과학 연구, 장문 컨텍스트 추론, 복잡한 에이전트 워크플로 등 실용적인 생산성 작업을 위해 설계되었습니다. Tencent Hy4 preview 또는 Hunyuan 4 preview라고도 불리며, 총 770B 파라미터, 토큰당 49B 활성 파라미터, 1M 토큰 이상의 컨텍스트 창을 지원합니다. 이 모델은 대규모 코드베이스와 문서 이해, 다단계 계획, 도구 사용, 디버깅, 검증, 지속적인 작업 실행에 강점을 보입니다.

최대 컨텍스트

1M

최대 출력

64K

출시일

2026년 8월 28일

입력$0.8571 / 백만 토큰
출력$2.5714 / 백만 토큰
캐시 읽기$0.0429 / 백만 토큰

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max는 고급 추론, 코딩 및 엔터프라이즈 생산성을 위해 설계된 2.4T 파라미터 MoE 플래그십 모델입니다. 소프트웨어 개발부터 전문 워크플로우까지 복잡하고 오래 지속되는 작업을 자율적으로 실행하며 법률, 금융, 디자인 등 다양한 분야에서 프로덕션급 결과를 제공합니다. 네이티브 멀티모달 인텔리전스로 구동되는 Qwen3.8-Max는 긴 컨텍스트에서 텍스트, 이미지, 비디오를 이해하고 광범위한 문서와 장문 콘텐츠의 심층 분석을 지원합니다. 에이전트 기능은 복잡한 워크플로우 전반에 걸쳐 자율적인 계획, 실행, 검증 및 지속적인 반복을 가능하게 합니다.

최대 컨텍스트

1M

최대 출력

128K

출시일

2026년 8월 3일

입력$2 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.25 / 백만 토큰

Moonshot

Kimi K3

kimi-k3

Kimi K3는 고급 추론, 코딩, 복잡한 작업 실행을 위해 설계된 고성능 AI 모델입니다. 대규모 프로그래밍 프로젝트, 다단계 문제 해결, 지식 집약적 애플리케이션에서 뛰어난 성능을 제공합니다. 광범위한 컨텍스트 처리와 멀티모달 기능을 갖춘 K3는 강력한 AI 에이전트, 개발자 도구, 엔터프라이즈급 애플리케이션을 구축하는 데 적합합니다.

최대 컨텍스트

1M

최대 출력

131.1K

출시일

2026년 7월 16일

입력$2.8571 / 백만 토큰
출력$14.2857 / 백만 토큰
캐시 읽기$0.2857 / 백만 토큰

DeepSeek

DeepSeek V4 Flash Vision Exp

deepseek-v4-flash-vision-exp

DeepSeek V4 Flash Vision Exp는 DeepSeek V4 Flash 0731의 실험적인 비전 지원 변형으로, 에이전트 기능, 추론 및 세계 지식을 포함한 기본 모델의 텍스트 성능을 유지하면서 이미지 이해 기능을 도입합니다. 희소 혼합 전문가(MoE) 아키텍처를 기반으로 총 284B 파라미터와 활성 13B 파라미터를 갖추고 있습니다.

최대 컨텍스트

1M

최대 출력

384K

출시일

2026년 8월 21일

입력$0.2857 / 백만 토큰
출력$1.1429 / 백만 토큰
캐시 읽기$0.0057 / 백만 토큰

인기 모델 추천

라이브 카탈로그에서 주목도가 높은 모델부터 살펴보고, 상세 페이지에서 컨텍스트, 엔드포인트, 실제 가격을 비교하세요.

OpenAI

GPT-6.1 Sol

GPT-6.1 Sol은 복잡한 문제 해결, 코딩 및 에이전트 기반 애플리케이션을 위해 구축된 고급 추론 모델입니다. 지능, 속도, 비용 간의 실용적인 균형을 유지하면서 강력한 추론 성능을 제공하도록 설계되었습니다. 주로 응답 생성에 초점을 맞춘 기존 채팅 모델과 달리, GPT-6.1 Sol은 다단계 추론, 코드 생성, 디버깅, 데이터 분석, 복잡한 지시 따르기 등 더 깊은 사고가 필요한 작업에 최적화되어 있습니다. GPT-6.1 Sol은 신뢰할 수 있는 추론 워크플로, 구조화된 출력, 도구 기반 애플리케이션을 지원하므로 AI 어시스턴트, 코딩 에이전트, 자동화 시스템, 프로덕션 AI 애플리케이션을 구축하는 개발자에게 적합합니다.

최대 컨텍스트

1.1M

입력 가격

$2 / 백만 토큰

모델 보기

OpenAI

GPT-6.1 Sol Pro

GPT-6.1 Sol Pro는 GPT-6.1 Sol의 향상된 추론 버전입니다. GPT-6.1 Sol과 동일한 기반 모델을 사용하지만 reasoning.mode=pro를 활성화하여 각 요청에 훨씬 더 많은 연산을 투입할 수 있습니다. 추가 추론 예산은 GPT-6.1 Sol Pro가 더 깊은 분석, 더 긴 계획, 더 높은 정확도를 요구하는 어려운 문제를 처리하는 데 도움이 됩니다. 응답 속도나 비용 효율성보다 최상의 답변을 얻는 것이 더 중요한 작업을 위해 설계되었습니다. GPT-6.1 Sol과 비교하여 GPT-6.1 Sol Pro는 요청당 훨씬 더 많은 추론 토큰을 소비하므로 사용 비용이 더 높고 응답 시간이 더 깁니다.

최대 컨텍스트

1.1M

입력 가격

$2 / 백만 토큰

모델 보기

Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5는 고급 추론, 코딩, 분석, 복잡한 에이전트 워크플로를 위해 설계된 차세대 AI 모델입니다. 소프트웨어 개발, 긴 컨텍스트 이해, 멀티모달 작업, 전문 지식 업무 전반에서 뛰어난 성능을 발휘하며 지능과 속도, 효율의 균형을 제공합니다. 향상된 추론 능력과 개선된 지시 수행 능력을 바탕으로 코드 작성 및 디버깅, 복잡한 문서 분석, 다단계 문제 해결, 신뢰할 수 있는 의사결정과 도구 사용이 필요한 AI 에이전트 구동에 탁월합니다.

최대 컨텍스트

1M

입력 가격

$2 / 백만 토큰

모델 보기

xAI

Grok 4.7

Grok 4.7은 고난도 코딩 작업, 복잡한 추론, 지식 집약적 애플리케이션을 위해 설계된 xAI의 최신 세대 모델입니다. 장기적인 문제 해결, 자기 검증, 워크플로 실행 능력을 향상시켜 지능형 어시스턴트와 AI 기반 제품을 만드는 개발자에게 적합합니다. Grok 4.7은 프로그래밍, 분석, 범용 AI 작업 전반에서 뛰어난 성능을 제공하면서 프로덕션 배포에 적합한 효율성도 유지합니다.

최대 컨텍스트

500K

입력 가격

$1.6 / 백만 토큰

모델 보기

Anthropic

Claude Opus 5.5

Claude Opus 5.5는 Anthropic의 플래그십 지능 모델로, 깊은 추론과 안정성, 장시간 작업 실행이 필요한 고부하 워크로드를 위해 설계되었습니다. 소프트웨어 엔지니어링, 에이전트 워크플로, 전문 분석, 지식 집약적 작업에서 뛰어난 성능을 발휘합니다. 향상된 효율성과 강화된 안전 장치를 갖춘 Claude Opus 5.5는 복잡한 작업 전반에서 일관된 성능을 요구하는 정교한 AI 애플리케이션을 개발하는 개발자에게 최적화되어 있습니다.

최대 컨텍스트

1M

입력 가격

$4 / 백만 토큰

모델 보기

OpenAI

GPT-6 Sol

GPT-6 Sol은 OpenAI GPT-6 시리즈의 고성능 모델로, 복잡한 추론 작업과 소프트웨어 개발, 전문 AI 워크플로를 위해 설계되었습니다. 다단계 문제 해결, 고급 코딩, 데이터 분석, 에이전트 기반 애플리케이션에서 향상된 지능을 제공합니다. GPT-6 Sol은 강력한 추론 능력과 효율적인 추론 성능을 결합하여, 프로덕션 AI 시스템에 최전선 수준의 성능이 필요한 개발자에게 적합합니다.

최대 컨텍스트

1.1M

입력 가격

$2 / 백만 토큰

모델 보기

모델 비교

선택한 인접 카탈로그 모델과 빠르게 비교합니다.

모델 카탈로그 FAQ

TokenHub 카탈로그에서 모델을 선택하고 비교하며 사용하는 방법을 빠르게 확인하세요.

이 목록에서 모델을 어떻게 선택해야 하나요?

+

먼저 작업 유형을 정하세요. 제공업체, 태그, 엔드포인트 유형, 과금 그룹으로 좁힌 뒤 컨텍스트 길이, 최대 출력, 모달리티, 입력 또는 출력 가격을 비교하세요.

실제 가격은 무엇을 의미하나요?

+

실제 가격은 활성 과금 그룹 비율을 모델 가격 데이터에 적용한 값입니다. 사용하는 그룹에서 입력, 출력 또는 요청당 비용을 추정하는 데 도움이 됩니다.

이 모델들을 API 엔드포인트로 사용할 수 있나요?

+

네. 모델 상세 페이지에서 지원되는 엔드포인트 유형과 문서 링크를 확인할 수 있습니다. 사용 가능 여부는 모델, 제공업체, 현재 라우팅 설정에 따라 달라질 수 있습니다.

컨텍스트 윈도우와 최대 출력은 왜 중요한가요?

+

컨텍스트 윈도우는 모델이 읽을 수 있는 프롬프트와 대화 기록의 양을 정합니다. 최대 출력은 한 번의 응답에서 생성할 수 있는 양을 정하며 긴 글, 코딩, 문서 작업에 중요합니다.