Alibaba
Qwen3.7 Plus
최대 컨텍스트
1M
최대 출력
64K
출시일
N/A
qwen3.8-maxQwen3.8-Max는 고급 추론, 코딩 및 엔터프라이즈 생산성을 위해 설계된 2.4T 파라미터 MoE 플래그십 모델입니다. 소프트웨어 개발부터 전문 워크플로우까지 복잡하고 오래 지속되는 작업을 자율적으로 실행하며 법률, 금융, 디자인 등 다양한 분야에서 프로덕션급 결과를 제공합니다. 네이티브 멀티모달 인텔리전스로 구동되는 Qwen3.8-Max는 긴 컨텍스트에서 텍스트, 이미지, 비디오를 이해하고 광범위한 문서와 장문 콘텐츠의 심층 분석을 지원합니다. 에이전트 기능은 복잡한 워크플로우 전반에 걸쳐 자율적인 계획, 실행, 검증 및 지속적인 반복을 가능하게 합니다.
Context Window
1M tokens
Maximum Output
128K tokens
Release Date
2026년 8월 3일
Modalities
| 입력 가격 | 출력 가격 | 캐시 읽기 | 캐시 생성 5m | 캐시 읽기 5m |
|---|---|---|---|---|
| $2/M | $6/M | $0.25/M | $2.5/M | $0.17/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Qwen3.8 Max는 추론, 네이티브 시각 이해, 장기 작업 계획, 100만 토큰 컨텍스트를 결합해 복잡한 전문 업무를 처리합니다.
이 플래그십 추론 모델은 고난도 코딩, 사무, 법률, 금융 및 디자인 관련 작업을 위해 설계되었습니다.
텍스트, 이미지, 동영상을 입력받아 시각 문서, 차트, 장시간 영상의 의미를 해석할 수 있습니다.
100만 토큰 컨텍스트와 자율 계획 역량으로 반복적인 분석과 개선이 필요한 장기 작업을 지원합니다.
Qwen3.8 Max는 엔지니어링 규모의 코딩, 전문 문서 분석, 장시간 실행되는 멀티모달 워크플로에 적합합니다.
대규모 코드베이스를 분석하고 구성 요소 간 변경을 조율하며 복잡한 소프트웨어 엔지니어링 작업을 반복적으로 완수합니다.
긴 법률, 금융 또는 비즈니스 자료를 검토하고 관련 근거를 추출해 구조화된 결과를 만듭니다.
차트, 문서 이미지, 장시간 영상을 해석해 사건과 관계를 추출하고 간결한 텍스트 요약을 생성합니다.
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)Qwen3.8 Max API, 요금, 코딩 및 에이전트 워크플로, 멀티모달 기능, 모델 비교에 관한 자주 묻는 질문입니다.
Qwen3.8 Max는 고급 추론, 코딩, 엔터프라이즈 생산성, 에이전트 워크플로를 위한 Qwen의 플래그십 MoE 모델입니다. 대규모 작업 문맥을 처리하고 복잡한 장기 작업을 지속적으로 수행해야 하는 프로덕션 환경에 적합합니다.
Qwen3.8 Max는 복잡한 코딩, 다단계 추론, 계획·실행·검증·반복이 필요한 에이전트 워크플로에 대해 평가할 가치가 있습니다. 프로덕션 기본 모델로 사용하기 전 실제 리포지토리 작업, 도구 호출, 품질 기준으로 검증해야 합니다.
이 페이지의 모달리티와 API 섹션에서 TokenHub를 통해 현재 사용할 수 있는 입력 유형과 엔드포인트를 확인하세요. 문서, 이미지 또는 비디오 워크플로의 경우 지원되는 요청 형식을 확인하고 대표적인 원본 자료로 테스트한 뒤 배포해야 합니다.
TokenHub API Key를 만든 뒤 이 페이지에 표시된 정확한 Qwen3.8 Max 모델 ID를 복사하고 API 섹션에서 지원되는 엔드포인트를 선택하세요. 생성된 요청 예제를 OpenAI 호환 클라이언트 또는 다른 지원 클라이언트 통합의 시작점으로 사용할 수 있습니다.
이 페이지에 표시된 현재 입력, 출력, 캐시 읽기 요금을 확인한 다음 일반적인 프롬프트 크기, 응답 길이, 요청량, 캐시 적중률을 기준으로 비용을 추정하세요. 장문맥, 멀티모달, 에이전트 워크플로는 단순 채팅과 비용 구조가 크게 다를 수 있습니다.
이 페이지의 모델 사양에 표시된 컨텍스트 길이와 최대 출력을 확인하세요. 컨텍스트는 하나의 요청에 포함할 수 있는 원본 자료의 양을, 최대 출력은 모델이 한 번의 응답으로 반환할 수 있는 콘텐츠 양을 결정합니다.
어떤 상황에서도 우위인 모델은 없습니다. 실제 워크로드를 기준으로 Qwen3.8 Max와 GLM-5.2의 코딩 및 에이전트 신뢰성, 추론 품질, 멀티모달 요구 사항, 컨텍스트와 출력 제한, 현재 요금, 엔드포인트 호환성을 비교하세요. 표준 모델로 정하기 전에 대표 프롬프트로 소규모 평가를 진행하는 것이 좋습니다.
하나의 API 키로 Qwen3.8 Max과 더 많은 AI 모델을 이용하세요.
Qwen3.8-Max 미디어 및 데모
Qwen3.8-Max에 관한 공개 발표, 데모 및 커뮤니티 토론 모음입니다.
X (Twitter)
Reddit
YouTube