Z.ai
GLM-5.3-FlashX
최대 컨텍스트
1M
최대 출력
131.1K
출시일
N/A
glm-4.5GLM-4.5은(는) 출처에서 355B 총 / 32B 활성 MoE, thinking and non-thinking modes을(를) 핵심 특징으로 제시합니다. 주요 가치는 추론, 코딩, 도구 사용 and browser-style 에이전트 워크플로에 있습니다. 따라서 일반 챗봇처럼 설명하기보다 이 모델만의 차별점을 중심으로 소개하는 것이 적합합니다.
Context Window
131.1K tokens
Maximum Output
98.3K tokens
Release Date
2025년 7월 28일
Modalities
| 입력 가격 | 출력 가격 |
|---|---|
| $0.4286/M | $2/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
GLM-4.5는 추론, 코딩, 에이전트 역량을 통합하고 하이브리드 사고 모드와 128K 컨텍스트를 제공하는 오픈 웨이트 텍스트 모델입니다.
추론, 코딩, 에이전트 중심 학습을 하나의 모델에 통합해 다단계 문제 해결과 소프트웨어 작업을 지원합니다.
복잡한 추론을 위한 사고 모드와 단순 작업을 위한 즉시 응답 모드를 제공해 작업에 맞게 추론 수준을 조정할 수 있습니다.
총 3,550억 개 중 320억 개 매개변수를 활성화하는 전문가 혼합 아키텍처를 사용하며 MIT 라이선스로 공개되었습니다.
GLM-4.5는 소프트웨어 엔지니어링 에이전트, 복잡한 텍스트 추론, 사고 깊이를 선택할 수 있는 자체 호스팅 개발 흐름에 적합합니다.
코드 변경을 계획하고 프로젝트 파일을 검사하며 여러 차례의 개발 작업에서 구현과 디버깅 단계를 수행합니다.
사고 모드에서 긴 기술 요구사항이나 다단계 논리 문제를 분석하고 근거 있는 텍스트 해결책을 생성합니다.
MIT 라이선스 오픈 웨이트를 통제된 인프라에 배포해 내부 코딩, 추론 또는 에이전트 작업에 활용합니다.
curl 'https://us-api.tokenhub.com/v1/messages' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"GLM-4.5 (Reasoning)
| 지표 점수 | ||
|---|---|---|
| Artificial Analysis Intelligence Index | 종합 역량 평가 | 19.5 |
| Artificial Analysis Coding Index | 코딩 역량 종합 평가 | 26.3 |
| Artificial Analysis Math Index | 수학적 추론 종합 평가 | 73.7 |
| 지식 및 추론 | ||
| MMLU-Pro | 고난도 다분야 지식 | 83.5% |
| GPQA | 고난도 과학 문제 해결 | 78.2% |
| HLE | 다분야 전문가 수준 평가 | 12.2% |
| 코딩 및 소프트웨어 엔지니어링 | ||
| LiveCodeBench | 최신 코딩 문제 | 73.8% |
| SciCode | 과학 컴퓨팅 코딩 과제 | 34.8% |
| Terminal-Bench Hard | 고난도 터미널 작업 수행 | 22.0% |
| 수학 | ||
| MATH-500 | 고난도 수학 문제 해결 | 97.9% |
| AIME | 수학 경시대회 형식 문제 | 87.3% |
| AIME 2025 | 수학 경시대회 형식 문제 | 73.7% |
| 지시 준수 및 에이전트 작업 | ||
| IFBench | 프롬프트 제약 준수 | 44.1% |
| AA-LCR | 긴 컨텍스트 추론 | 48.3% |
| τ²-Bench | 에이전트 워크플로 작업 | 43.0% |
지표 출처 Artificial Analysis
GLM-4.5의 역량, 활용 사례, 한계와 TokenHub 사용 안내.
GLM-4.5는 Z.AI의 추론·코딩·네이티브 에이전트 워크플로용 모델입니다.
코드 추론, 에이전트 워크플로, 도구 중심 자동화에 적합하며, 특히 우선순위가 깊은 추론인 경우 유용합니다.
핵심 강점은 추론·코딩·네이티브 에이전트의 통합입니다.
이전 세대라 후속 모델의 새로운 기능이 없을 수 있습니다. 최신 기능이 중요함이 우선이면 GLM-5를 고려하세요.
TokenHub 제공 여부를 확인하고 신규 작업에는 현재 후속 모델을 우선하세요.
하나의 API 키로 GLM-4.5과 더 많은 AI 모델을 이용하세요.
미디어 및 논의
이 모델과 관련된 공개 동영상과 게시물을 선별했습니다.
X (Twitter)
Reddit
YouTube