/v1/chat/completionsQwen3.8 Max
qwen3.8-maxQwen3.8-Max는 고급 추론, 코딩 및 엔터프라이즈 생산성을 위해 설계된 2.4T 파라미터 MoE 플래그십 모델입니다. 소프트웨어 개발부터 전문 워크플로우까지 복잡하고 오래 지속되는 작업을 자율적으로 실행하며 법률, 금융, 디자인 등 다양한 분야에서 프로덕션급 결과를 제공합니다. 네이티브 멀티모달 인텔리전스로 구동되는 Qwen3.8-Max는 긴 컨텍스트에서 텍스트, 이미지, 비디오를 이해하고 광범위한 문서와 장문 콘텐츠의 심층 분석을 지원합니다. 에이전트 기능은 복잡한 워크플로우 전반에 걸쳐 자율적인 계획, 실행, 검증 및 지속적인 반복을 가능하게 합니다.
최대 컨텍스트
1M토큰
최대 출력
128K토큰
출시일
2026년 8월 3일
모달리티
Qwen3.8 Max 가격
| 입력 가격 | 출력 가격 | 캐시 읽기 | 캐시 생성 5m | 캐시 읽기 5m |
|---|---|---|---|---|
| $2/M | $6/M | $0.25/M | $2.5/M | $0.17/M |
API를 통해 Qwen3.8 Max을(를) 사용하는 방법은 무엇인가요?
/v1/responses/v1/messagesQwen3.8-Max 자주 묻는 질문
Qwen3.8-Max의 기능, 활용 사례, 요금 및 TokenHub 사용 방법에 관한 실용적인 답변입니다.
Qwen3.8-Max는 무엇인가요?+
Qwen3.8-Max는 Alibaba Qwen 팀의 플래그십 전문가 혼합 모델입니다. 텍스트, 이미지, 동영상을 입력받아 텍스트를 출력하며, 제공사가 공개한 규모는 총 2.4조 개 매개변수와 950억 개 활성 매개변수입니다.
Qwen3.8-Max는 어떤 용도에 가장 적합한가요?+
고급 코딩, 장시간 에이전트 워크플로, 복잡한 전문 업무, 긴 문서나 동영상의 멀티모달 분석에 특히 적합합니다.
Qwen3.8-Max의 주요 강점은 무엇인가요?+
100만 토큰 컨텍스트, 선택형 사고 모드, 함수 호출, 구조화 출력, 웹 검색과 코드 해석 같은 내장 도구, 네이티브 시각 이해가 주요 강점입니다.
Qwen3.8-Max 사용 시 어떤 절충점을 고려해야 하나요?+
플래그십 성능은 경량 Qwen 모델보다 비용과 처리 시간이 늘어날 수 있습니다. 장시간 에이전트 실행은 오류와 지출을 누적시킬 수 있으므로 예산과 체크포인트를 설정하고 중요한 출력을 검토하세요.
TokenHub에서 Qwen3.8-Max를 어떻게 사용하나요?+
TokenHub의 모델 필드에서 qwen3.8-max를 선택한 뒤 계정 인증 정보로 TokenHub 엔드포인트에 요청을 보내세요. 운영 환경에 적용하기 전에 계정에 표시된 지원 매개변수, 입력 형식 및 제한을 확인하세요.
Qwen3.8-Max의 요금과 제공 방식은 어떻게 되나요?+
2026년 8월 기준 QwenCloud의 qwen3.8-max API 요금은 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러, 암시적 캐시 입력 100만 토큰당 0.25달러입니다. TokenHub의 제공 여부와 과금은 다를 수 있으므로 실시간 모델 페이지를 확인하세요.
다른 모델보다 Qwen3.8-Max를 선택해야 하는 경우는 언제인가요?+
복잡한 코딩, 멀티모달 추론 또는 장시간 에이전트 작업에 Qwen의 최고 성능이 필요할 때 선택하세요. 비용에 민감한 워크로드라면 qwen3.7-plus 또는 qwen3.7-flash와 비교하고 대표 작업에서 품질, 지연 시간 및 비용을 평가하세요.
Qwen3.8-Max 미디어 및 데모
Qwen3.8-Max에 관한 공개 발표, 데모 및 커뮤니티 토론 모음입니다.
X (Twitter)
Reddit
YouTube