Gemini 3.6 Flash
Максимальный контекст
1M
Максимальный вывод
65.5K
Дата выпуска
N/A
gemini-3.1-flash-liteGemini 3.1 Flash Lite в источниках выделяется следующими характеристиками: high-efficiency мультимодальный model with text/image/video/audio/поддержка PDF. Основная ценность модели связана с извлечение, маршрутизация, классификация and lightweight мультимодальный agents. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.
Context Window
1M tokens
Maximum Output
65.5K tokens
Release Date
7 мая 2026 г.
Modalities
| Цена входа | Цена выхода | Чтение кэша | Создание кэша 5m |
|---|---|---|---|
| $0.25/M | $1.5/M | $0.025/M | $0.0833/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Gemini 3.1 Flash-Lite сочетает мультимодальную обработку с малой задержкой, длинный контекст и облегчённое рассуждение для частых массовых задач.
Эффективно обрабатывает простые частые запросы, когда ключевыми ограничениями являются время ответа и стоимость работы.
Принимает текст, изображения, видео, аудио и PDF для масштабируемой классификации, извлечения и преобразования.
Может выделять дополнительные ресурсы на рассуждение, когда простой задаче нужна большая точность, без перехода на крупную модель.
Gemini 3.1 Flash-Lite подходит для массового перевода, транскрибации мультимедиа и процессов структурированного извлечения или маршрутизации.
Переводить большие потоки сообщений, отзывов или обращений поддержки, сохраняя краткий формат результата.
Преобразовывать записи, голосовые заметки или речь из видео в доступный для поиска текст без отдельного конвейера распознавания речи.
Классифицировать запросы, извлекать сущности по заданной схеме и направлять каждый элемент в подходящий последующий процесс.
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)Gemini 3.1 Flash-Lite
| Индексный балл | ||
|---|---|---|
| Artificial Analysis Intelligence Index | Сводная оценка общих возможностей | 25 |
| Artificial Analysis Coding Index | Сводная оценка навыков программирования | 30.1 |
| Знания и рассуждения | ||
| GPQA | Решение сложных научных задач | 82.2% |
| HLE | Экспертные задания по широкому кругу тем | 16.2% |
| Программирование и разработка ПО | ||
| SciCode | Задачи по научному программированию | 41.9% |
| Terminal-Bench Hard | Сложные задачи в терминале | 24.2% |
| Следование инструкциям и агентные задачи | ||
| IFBench | Соблюдение условий промпта | 77.2% |
| AA-LCR | Рассуждения в длинном контексте | 65.3% |
| τ²-Bench | Агентные рабочие процессы | 31.3% |
Источник метрик Artificial Analysis
Узнайте, что представляет собой Gemini 3.1 Flash-Lite, для каких задач подходит, чем выделяется, какие имеет ограничения и что проверить при интеграции через TokenHub.
Gemini 3.1 Flash-Lite — низколатентная экономичная модель Google серии Gemini 3 для частых легких мультимодальных задач. Это текущая публичная модель провайдера, однако доступность может различаться по платформам.
Подходящие сценарии: массовой классификации и маршрутизации, простого извлечения структурированных данных и массового перевода. Перед промышленным использованием протестируйте типичные данные и задайте измеримые критерии приемки.
Ключевые преимущества: быстрый отклик, экономичное масштабирование и поддержка различных мультимодальных входов. Такое сочетание особенно полезно для простого извлечения структурированных данных.
Рассмотрите другую модель, если задача требует максимального уровня рассуждений Pro, нужна тонкая длинная генерация или сложное рассуждение или в процессе нельзя предусмотреть проверку человеком для важных решений. Важные фактические, юридические, финансовые, медицинские и операционные результаты должен проверять квалифицированный специалист.
В TokenHub выберите точный идентификатор, показанный для Gemini 3.1 Flash-Lite, используйте endpoint из документации вашего аккаунта и учетные данные TokenHub. Проверьте типы входов, инструменты, варианты обоснования и жизненный цикл, реально доступные в TokenHub, не предполагая полного совпадения с Gemini API.
Получите доступ к Gemini 3.1 Flash-Lite и другим моделям ИИ с одним API-ключом TokenHub.
Материалы и обсуждения
Подборка публичных видео и публикаций, связанных с этой моделью.
X (Twitter)
Reddit
YouTube