Gemini 3.6 Flash
gemini-3.6-flash
최대 컨텍스트
1M
최대 출력
65.5K
출시일
N/A
입력$1.5 / 백만 토큰
출력$7.5 / 백만 토큰
gemma-4-31b-itGemma 4 26B A4B는 Google DeepMind의 효율적인 Mixture-of-Experts(MoE) 모델로, 26B급 모델 용량과 추론 시 약 4B의 활성 파라미터를 결합했습니다. 뛰어난 추론, 코딩, 멀티모달 이해, 에이전트 기능을 제공하면서 대규모 덴스 모델보다 더 빠르고 효율적인 추론이 가능합니다. 텍스트와 이미지 입력, 256K 컨텍스트 창, 네이티브 함수 호출, 140개 이상의 언어를 지원하여 AI 에이전트, 코딩 애플리케이션, 장문 컨텍스트 처리, 고처리량 워크로드에 적합합니다.
Context Window
262.1K tokens
Maximum Output
32.8K tokens
Release Date
2026년 4월 2일
Modalities
| 입력 가격 | 출력 가격 | 캐시 읽기 |
|---|---|---|
| $0.75/M | $1/M | $0.75/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)하나의 API 키로 Gemma 4 31B과 더 많은 AI 모델을 이용하세요.