/v1/chat/completionsStep 3.7 Flash
step-3.7-flashStep 3.7 Flash는 StepFun이 개발한 고효율 멀티모달 Mixture-of-Experts(MoE) 모델로, 프로덕션 규모의 에이전트 및 개발자 워크로드를 위해 설계되었습니다. 네이티브 텍스트 및 이미지 이해, 256K 컨텍스트 창, 유연한 추론 기능을 갖추고 있어 코딩, 시각 및 문서 분석, 도구 호출, 검색 증강 작업, 복잡한 다단계 에이전트 워크플로우에 적합합니다. 희소한 198B 아키텍처는 토큰당 약 11B 파라미터만 활성화하여 강력한 추론 및 멀티모달 성능과 효율적인 추론 간의 균형을 유지합니다.
최대 컨텍스트
256K토큰
최대 출력
256K토큰
출시일
2026년 5월 29일
모달리티
Step 3.7 Flash 가격
| 입력 가격 | 출력 가격 | 캐시 읽기 |
|---|---|---|
| $0.2/M | $1.15/M | $0.04/M |
API를 통해 Step 3.7 Flash을(를) 사용하는 방법은 무엇인가요?
/v1/responses/v1/messagesStep 3.7 Flash 벤치마크
Step 3.7 Flash
30.9
/100
Artificial Analysis Intelligence Index
Artificial Analysis broad capability aggregate
지표 점수
39.6
/100
Artificial Analysis Coding Index
Artificial Analysis software task aggregate
지표 점수
지표 출처 Artificial Analysis
Step 3.7 Flash 관련 글
step-3.7-flash 자주 묻는 질문
TokenHub에서 step-3.7-flash를 사용할 때 자주 묻는 질문입니다.
step-3.7-flash는 무엇인가요?+
step-3.7-flash는 에이전트 워크플로, 코딩, 검색, 도구 사용 및 이미지 이해를 위해 설계된 StepFun의 오픈 웨이트 희소 전문가 혼합 비전 언어 모델입니다.
step-3.7-flash는 어떤 용도에 가장 적합한가요?+
도구를 사용하는 에이전트, 저장소 규모의 코딩, UI 및 문서의 시각 분석, 연구 워크플로, 그리고 인식과 추론을 결합하는 고처리량 작업에 적합합니다.
step-3.7-flash의 주요 강점은 무엇인가요?+
네이티브 비전, 긴 컨텍스트 처리, 세 가지 추론 수준, 안정적인 도구 사용에 대한 초점, 개방형 배포 선택지 덕분에 프로덕션 에이전트 시스템에 유연하게 적용할 수 있습니다.
어떤 한계나 절충점을 고려해야 하나요?+
자체 호스팅하기에는 매우 큰 모델이므로 로컬 배포에 상당한 메모리와 연산 자원이 필요할 수 있습니다. 출력에는 오류가 있을 수 있으니 중요한 결과를 검증하고 실제 워크로드에서 품질, 지연 시간 및 비용을 비교하세요.
TokenHub API에서 step-3.7-flash를 어떻게 사용하나요?+
TokenHub API 요청에서 모델을 step-3.7-flash로 지정하고 TokenHub 계정에 표시된 엔드포인트와 인증 정보를 사용하세요. 지원되는 텍스트 및 이미지 페이로드는 TokenHub의 최신 안내를 따르세요.
step-3.7-flash의 가격과 제공 방식은 어떻게 되나요?+
TokenHub의 가격, 제공 지역 및 할당량은 바뀔 수 있으므로 배포 전에 실시간 모델 목록과 계정 정보를 확인하세요. 이 모델은 오픈 웨이트와 외부 호스팅 선택지도 제공하지만 TokenHub에서의 이용 가능 여부는 TokenHub 정책을 따릅니다.
다른 모델 대신 step-3.7-flash를 선택해야 하는 경우는 언제인가요?+
도구 사용과 개방형 배포 선택지가 있는 빠른 멀티모달 에이전트 모델이 필요할 때 적합합니다. 단순한 텍스트 작업은 더 작은 모델과 비교하고, 최고 정확도가 필요하면 자체 데이터로 더 강력한 대안을 평가하세요.
Step-3.7-flash 미디어 및 데모
step-3.7-flash에 관한 공개 발표, 테스트 및 커뮤니티 토론을 선별했습니다.
X (Twitter)
Reddit
YouTube