Qwen3.8-Max는 고급 추론, 코딩 및 엔터프라이즈 생산성을 위해 설계된 2.4T 파라미터 MoE 플래그십 모델입니다. 소프트웨어 개발부터 전문 워크플로우까지 복잡하고 오래 지속되는 작업을 자율적으로 실행하며 법률, 금융, 디자인 등 다양한 분야에서 프로덕션급 결과를 제공합니다. 네이티브 멀티모달 인텔리전스로 구동되는 Qwen3.8-Max는 긴 컨텍스트에서 텍스트, 이미지, 비디오를 이해하고 광범위한 문서와 장문 콘텐츠의 심층 분석을 지원합니다. 에이전트 기능은 복잡한 워크플로우 전반에 걸쳐 자율적인 계획, 실행, 검증 및 지속적인 반복을 가능하게 합니다.
입력$2 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.25 / 백만 토큰
Kimi K3는 고급 추론, 코딩, 복잡한 작업 실행을 위해 설계된 고성능 AI 모델입니다. 대규모 프로그래밍 프로젝트, 다단계 문제 해결, 지식 집약적 애플리케이션에서 뛰어난 성능을 제공합니다. 광범위한 컨텍스트 처리와 멀티모달 기능을 갖춘 K3는 강력한 AI 에이전트, 개발자 도구, 엔터프라이즈급 애플리케이션을 구축하는 데 적합합니다.
입력$2.8571 / 백만 토큰
출력$14.2857 / 백만 토큰
캐시 읽기$0.2857 / 백만 토큰
GPT-5.6 Sol은 Sol 시리즈의 표준 버전으로, 일반 Q&A, 텍스트 처리, 콘텐츠 초안 작성, 요약, 가벼운 코딩 지원 및 비즈니스 자동화 작업에 적합합니다.
Sol은 탄탄한 범용 성능을 유지하면서 응답 효율성과 비용을 고려해야 하는 시나리오를 위해 설계되었습니다. 제품 기능, 채팅 도우미, 콘텐츠 생성 도구, 데이터 정제, 지식 기반 Q&A, 배치 처리 작업에 사용할 수 있습니다. 대규모 사용이나 빠른 프로토타이핑을 위한 유연한 출발점입니다.
입력$5 / 백만 토큰
출력$30 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰
GPT-5.6 Sol Pro는 Sol 시리즈의 Pro 버전으로, 복잡한 작업과 고품질 출력을 위해 설계되었습니다. 고급 글쓰기, 정밀한 Q&A, 비즈니스 추론, 코드 생성, 구조화된 분석 및 다중 턴 작업 실행에 적합합니다.
Sol Pro는 더 높은 정확성, 문맥 이해, 지시 완료가 요구되는 작업에 적합하며, 전문 콘텐츠 제작, 데이터 분석 어시스턴트, 지식 Q&A 시스템, 복잡한 에이전트 워크플로우, 기업 내부 AI 도구로 사용할 수 있습니다.
입력$5 / 백만 토큰
출력$30 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰
GPT-5.6 Terra는 Terra 시리즈의 범용 버전으로, 일상 대화, 텍스트 생성, 요약, 정보 추출, 경량 추론 및 코딩 지원에 적합합니다.
Terra는 범용 성능, 응답 효율성, 비용 간의 실용적인 균형을 제공합니다. 채팅 도우미, 콘텐츠 도구, 사무 자동화, 지식 베이스 Q&A, 배치 텍스트 처리 워크플로에 사용할 수 있습니다. 빠른 반복 작업이나 비용에 민감한 애플리케이션에 Terra 시리즈 중에서 Terra를 강력한 기본 옵션으로 선택할 수 있습니다.
입력$2.5 / 백만 토큰
출력$15 / 백만 토큰
캐시 읽기$0.275 / 백만 토큰
GPT-5.6 Terra Pro는 Terra 시리즈의 향상된 버전으로, 복잡한 작업에서 고품질 출력을 제공하도록 설계되었습니다. 고급 Q&A, 심층 콘텐츠 제작, 비즈니스 분석, 코딩 지원, 다단계 추론에 적합합니다. 표준 버전과 비교하여 더 높은 신뢰성, 완전한 추론, 우수한 명령 이행이 필요한 시나리오에 더 적합합니다. 전문 작문, 복잡한 정보 통합, 지식 기반 어시스턴트, 자동화 에이전트, 엔터프라이즈급 AI 애플리케이션에 적합합니다.
입력$2.5 / 백만 토큰
출력$15 / 백만 토큰
캐시 읽기$0.275 / 백만 토큰
GPT-5.6 Luna는 Luna 시리즈의 범용 버전으로, 일상적인 AI 애플리케이션에 적합합니다. 채팅 Q&A, 텍스트 재작성, 요약, 정보 추출, 간단한 추론, 코딩 지원, 사무 자동화에 사용할 수 있습니다.
Luna는 프로토타입, 경량 비즈니스 기능, 배치 콘텐츠 처리, 일반적인 사용자 상호작용 시나리오에 실용적인 선택입니다. 속도, 단순성, 비용 관리가 중요할 때 좋은 시작 모델이며, 더 높은 품질이나 안정적인 출력이 필요한 작업에는 Luna Pro를 고려할 수 있습니다.
입력$1 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰
GPT-5.6 Luna Pro는 Luna 시리즈의 향상된 버전으로, 더 높은 품질의 답변, 더 안정적인 명령 수행, 더 강력한 작업 완료를 목표로 합니다. 복잡한 대화, 콘텐츠 생성, 지식 Q&A, 비즈니스 분석, 코딩 지원, 다단계 자동화 작업에 적합합니다.
Luna Pro는 전문 글쓰기 도우미, 기업 AI 어시스턴트, 고객 지원, 지식 베이스 시스템, 에이전트 워크플로우 등 출력 품질과 사용자 경험이 중요한 제품 환경에 매우 적합합니다. 표준 Luna 모델보다 더 높은 신뢰성이 필요한 작업에 좋은 선택입니다.
입력$1 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰
DeepSeek V4 Pro은(는) 출처에서 MoE 1.6T 총 / 49B 활성, 1M-token 컨텍스트, hybrid 긴 컨텍스트 attention을(를) 핵심 특징으로 제시합니다. 주요 가치는 고급 추론, 코딩, 전체 코드베이스 분석 and 장기 에이전트 워크플로에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.
입력$1.2857 / 백만 토큰
출력$3.8571 / 백만 토큰
캐시 읽기$0.0429 / 백만 토큰
GLM-5.2는 장기 엔지니어링 작업을 위한 Z.ai의 플래그십 기반 모델입니다. 실제로 활용 가능한 1M 토큰 컨텍스트 창을 강조하며, 프로젝트 규모의 코드, 문서, 시스템 맥락을 함께 처리할 수 있습니다. 요구사항 분석, 저장소 이해, 구현, 테스트, 멀티플랫폼 배포까지 이어지는 전체 개발 워크플로에 적합합니다.
입력$1.1429 / 백만 토큰
출력$4 / 백만 토큰
캐시 읽기$0.2857 / 백만 토큰
DeepSeek V4 Flash은(는) 출처에서 MoE 284B 총 / 13B 활성, 1M-token 컨텍스트, 처리량 중심 추론을(를) 핵심 특징으로 제시합니다. 주요 가치는 대량 프로덕션 호출, 빠른 긴 컨텍스트 처리 and 비용 민감형 자동화에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.
입력$0.4286 / 백만 토큰
출력$1.2857 / 백만 토큰
캐시 읽기$0.0143 / 백만 토큰
Claude Opus 5는 Anthropic의 플래그십 모델로, 까다로운 추론, 코딩, 장기 에이전트 작업을 위해 설계되었습니다. 종단 간 소프트웨어 작업, 코드 리뷰 및 버그 발견, 차트 및 문서의 시각적 분석, 복잡한 사무 작업, 병렬 하위 에이전트 조정에 특히 뛰어납니다. 이 모델은 확장된 작업에서 강력한 명령 수행 및 도구 사용을 유지하면서도 지연 시간과 토큰 효율성을 우선시하는 낮은 노력 설정에서도 효과적입니다.
입력$5 / 백만 토큰
출력$25 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰
Opus 5의 고속 모드 변형 - 일반 Opus 5와 동일한 성능, 더 빠른 출력 속도, 일반 Opus 5 대비 2배 가격.
자세한 내용은 Anthropic 문서 참조: https://platform.claude.com/docs/en/build-with-claude/fast-mode
입력$10 / 백만 토큰
출력$50 / 백만 토큰
캐시 읽기$1 / 백만 토큰
Grok 4.6은 xAI의 고급 추론 모델로, 복잡한 프로그래밍, 장기 실행 에이전트 작업, 지식 작업을 위해 설계되었습니다. 텍스트 및 이미지 입력을 지원하며 최대 50만 토큰의 컨텍스트 창과 낮음/중간/높음/매우 높음 추론 강도를 구성할 수 있습니다. 함수 호출, 웹·X 검색, 코드 실행, 구조화된 출력을 갖춘 Grok 4.6은 여러 코드베이스 분석, 지속적인 다단계 도구 사용, 자체 검증, 엔드투엔드 엔지니어링 워크플로우에 최적화되어 있습니다. 이는 단순히 X 플랫폼과 연결된 챗봇이 아니라 범용 추론 및 에이전트 모델로 이해해야 합니다.
입력$2 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.3 / 백만 토큰
Gemini 3.6 Flash는 코딩, 에이전트 워크플로, 웹 및 앱 개발을 위한 Google의 고효율 모델입니다. 불필요한 편집과 모호한 표현을 줄여 정제된 출력을 생성하도록 설계되었으며, 작업 완료에 필요한 토큰 사용량과 모델 호출 횟수를 감소시킵니다.
입력$1.5 / 백만 토큰
출력$7.5 / 백만 토큰
캐시 읽기$0.15 / 백만 토큰
Grok 4.5는 프로그래밍, 에이전트 작업 및 지식 작업을 위한 xAI의 추론 모델입니다. 텍스트 및 이미지 입력, 최대 50만 토큰 컨텍스트, 낮음/중간/높음 구성 가능한 추론 강도를 지원합니다. 함수 호출, 웹 및 X 검색, 코드 실행, 구조화된 출력을 지원하며, 긴 컨텍스트 분석, 다단계 도구 호출 및 엔드투엔드 엔지니어링 워크플로에 적합합니다. X 플랫폼에 연결된 단순한 챗봇으로만 간주되어서는 안 됩니다.
입력$2 / 백만 토큰
출력$6 / 백만 토큰
캐시 읽기$0.3 / 백만 토큰
Qwen3.7 Plus은(는) 출처에서 text+image input, vision-language upgrade, hybrid agent capability을(를) 핵심 특징으로 제시합니다. 주요 가치는 GUI 작업, 모바일 내비게이션, 시각 참조 워크플로 and 비용 효율적 Qwen3.7 use에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.
입력$0.2857 / 백만 토큰
출력$1.1429 / 백만 토큰
캐시 읽기$0.0571 / 백만 토큰
GPT-4.1은(는) 출처에서 improved 코딩, instruction following and long 컨텍스트 versus earlier GPT-4 generation을(를) 핵심 특징으로 제시합니다. 주요 가치는 개발자 도구, 프로그래밍 지원 and instruction-heavy tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.
입력$2 / 백만 토큰
출력$8 / 백만 토큰
캐시 읽기$0.5 / 백만 토큰
GPT-4.1 Mini은(는) 출처에서 빠른er/lower-cost GPT-4.1 variant을(를) 핵심 특징으로 제시합니다. 주요 가치는 대량 developer features, 구조화 generation and 추출에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.
입력$0.4 / 백만 토큰
출력$1.6 / 백만 토큰
캐시 읽기$0.1 / 백만 토큰
GPT-4o은(는) 출처에서 멀티모달 GPT-4o flagship, text/image input and broad general intelligence을(를) 핵심 특징으로 제시합니다. 주요 가치는 vision-language applications, 자연스러운 상호작용 and general assistant tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.
입력$2.5 / 백만 토큰
출력$10 / 백만 토큰
캐시 읽기$1.25 / 백만 토큰
GPT-4o Mini은(는) 출처에서 small affordable GPT-4o model with text/image input and 구조화 output support을(를) 핵심 특징으로 제시합니다. 주요 가치는 lightweight 멀티모달 production, 파인튜닝, 증류 and focused tasks에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.
입력$0.15 / 백만 토큰
출력$0.6 / 백만 토큰
캐시 읽기$0.075 / 백만 토큰