Gemini 3.6 Flash
Максимальный контекст
1M
Максимальный вывод
65.5K
Дата выпуска
N/A
gemini-2.5-flash-liteGemini 2.5 Flash Lite в источниках выделяется следующими характеристиками: быстраяest/budget Gemini 2.5 option, thinking budgets and tool integrations. Основная ценность модели связана с классификация, перевод, маршрутизация, извлечение and high-scale workloads. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.
Context Window
1M tokens
Maximum Output
65.5K tokens
Release Date
17 июн. 2025 г.
Modalities
| Цена входа | Цена выхода | Чтение кэша |
|---|---|---|
| $0.1/M | $0.4/M | $0.01/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Gemini 2.5 Flash-Lite ориентирован на низкую задержку и эффективную мультимодальную обработку частых лёгких задач в большом масштабе.
Модель оптимизирована для быстрого выполнения лёгких запросов, что подходит интерактивным приложениям и высокочастотной обработке.
Модель понимает текст, изображения, видео, аудио и PDF-файлы и формирует текстовые результаты для последующей обработки.
Лимит входа в 1 048 576 токенов позволяет обрабатывать длинные документы и крупные коллекции меньшим числом запросов.
Gemini 2.5 Flash-Lite подходит для массовой классификации, простого извлечения данных и обработки контента с жёсткими требованиями к задержке.
Быстро присваивать категории, приоритеты или метки модерации большим потокам текста и мультимодального контента.
Извлекать типовые поля и факты из сообщений, форм, изображений и PDF для индексации и последующей автоматизации.
Сжимать длинные документы и PDF в краткие обзоры, ключевые тезисы или метаданные маршрутизации для конвейеров обработки контента.
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)| Индексный балл | ||
|---|---|---|
| Artificial Analysis Intelligence Index | Сводная оценка общих возможностей | 11.4 |
| Artificial Analysis Coding Index | Сводная оценка навыков программирования | 9.5 |
| Artificial Analysis Math Index | Сводная оценка математического мышления | 53.3 |
| Знания и рассуждения | ||
| MMLU-Pro | Сложные задания по разным областям знаний | 75.9% |
| GPQA | Решение сложных научных задач | 62.5% |
| HLE | Экспертные задания по широкому кругу тем | 6.4% |
| Программирование и разработка ПО | ||
| LiveCodeBench | Актуальные задачи по программированию | 59.3% |
| SciCode | Задачи по научному программированию | 19.3% |
| Terminal-Bench Hard | Сложные задачи в терминале | 4.5% |
| Математика | ||
| MATH-500 | Решение сложных математических задач | 96.9% |
| AIME | Олимпиадные задачи по математике | 70.3% |
| AIME 2025 | Олимпиадные задачи по математике | 53.3% |
| Следование инструкциям и агентные задачи | ||
| IFBench | Соблюдение условий промпта | 49.9% |
| AA-LCR | Рассуждения в длинном контексте | 51.3% |
| τ²-Bench | Агентные рабочие процессы | 18.4% |
Источник метрик Artificial Analysis
Узнайте, что представляет собой Gemini 2.5 Flash-Lite, для каких задач подходит, чем выделяется, какие имеет ограничения и что проверить при интеграции через TokenHub.
Gemini 2.5 Flash-Lite — самая экономичная модель Google Gemini 2.5 для простых и частых мультимодальных задач. Это отдельное поколение модели, но для новых проектов стоит сравнить его с более свежими моделями той же серии.
Подходящие сценарии: массовой классификации и маршрутизации, простого извлечения структурированных данных и массового перевода. Перед промышленным использованием протестируйте типичные данные и задайте измеримые критерии приемки.
Ключевые преимущества: экономичное масштабирование, быстрый отклик и поддержка различных мультимодальных входов. Такое сочетание особенно полезно для простого извлечения структурированных данных.
Рассмотрите другую модель, если задача включает сложное многошаговое рассуждение, проект может перейти на новое поколение Gemini или в процессе нельзя предусмотреть проверку человеком для важных решений. Важные фактические, юридические, финансовые, медицинские и операционные результаты должен проверять квалифицированный специалист.
В TokenHub выберите точный идентификатор, показанный для Gemini 2.5 Flash-Lite, используйте endpoint из документации вашего аккаунта и учетные данные TokenHub. Проверьте типы входов, инструменты, варианты обоснования и жизненный цикл, реально доступные в TokenHub, не предполагая полного совпадения с Gemini API.
Получите доступ к Gemini 2.5 Flash-Lite и другим моделям ИИ с одним API-ключом TokenHub.
Материалы и обсуждения
Подборка публичных видео и публикаций, связанных с этой моделью.
X (Twitter)
Reddit
YouTube