Ключевые данные
- Провайдер
- Идентификатор
- gemini-3.1-flash-lite
- Контекст
- 1M
- Лимит ответа
- 65K
- Срез знаний
- Январь 2025 г.
- Единица цены
- За 1 млн токенов
Gemini 3.1 Flash-Lite API в России: быстрая мультимодальная модель Google для больших документов и массовых задач от $0.25 за 1 млн входных токенов.
Идентификатор модели в API NeuroAPI
gemini-3.1-flash-liteВозможности модели
Возможности показаны по текущим данным каталога NeuroAPI. Фактическая скорость зависит от объёма контекста и нагрузки.
текст, изображения, аудио, файлы
текст
Пример запроса
Отправьте первый запрос к gemini-3.1-flash-lite через OpenAI-совместимый endpoint NeuroAPI. Подробнее — в разделе документации.
curl --location 'https://neuroapi.host/v1/chat/completions' \
--header 'Authorization: Bearer NEUROAPI_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "gemini-3.1-flash-lite",
"messages": [
{ "role": "user", "content": "Привет! Напиши короткое приветственное сообщение для нового пользователя." }
]
}'Простое текстовое сообщение — самый короткий путь к первому ответу модели.
Подробнее в документацииФакты из каталога
Проверяемые данные
Название, доступность, возможности и единицы тарификации берутся из текущего публичного каталога NeuroAPI. Цена зависит от выбранной модели и тарифа, поэтому перед интеграцией сверяйте карточку и каталог.
Цена
| Тариф | Входящие токены | Исходящие токены | Контекст |
|---|---|---|---|
Пилот экономичный | 16,20 ₽ | 97,20 ₽ | 256000 |
Оптимальный официальные API | 30,27 ₽ | 181,64 ₽ | 1M |
Итоговая стоимость зависит от тарифа и фактического объёма запросов.
Создать API-ключПодробности
Gemini 3.1 Flash-Lite — быстрая и экономичная мультимодальная модель Google для приложений с большим потоком запросов. Через API NeuroAPI она доступна по официальному идентификатору `gemini-3.1-flash-lite` с оплатой в рублях. Стоимость составляет $0.25 за 1 млн входных текстовых токенов и $1.50 за 1 млн выходных токенов. ## Возможности Gemini 3.1 Flash-Lite Модель принимает текст, изображения, аудио и документы, а возвращает текст. Она поддерживает потоковую генерацию, вызов функций, структурированный JSON-ответ и управляемое рассуждение. Официальное контекстное окно модели достигает 1 048 576 токенов, максимальный ответ — 65 536 токенов. Для тарифов «Пилот» и «Оптимальный» действует лимит 256 000 токенов на запрос: его достаточно для анализа больших документов, длинных диалогов и крупных наборов данных без дробления на короткие фрагменты. ## Для каких задач подходит - чат-боты и автоматизация службы поддержки; - извлечение данных, классификация, разметка и модерация контента; - суммаризация договоров, отчётов, исследований и PDF-документов; - перевод и обработка многоязычных текстов; - анализ изображений и аудио вместе с текстовым контекстом; - RAG, function calling и лёгкие AI-агенты; - массовая генерация описаний, ответов и структурированных данных. ## Скорость и бенчмарки В опубликованной Google DeepMind карточке модели за март 2026 года Gemini 3.1 Flash-Lite показала 363 токена в секунду против 249 у Gemini 2.5 Flash. Там же указаны результаты GPQA Diamond 86.9%, MMMU-Pro 76.8%, Video-MMMU 84.8% и LiveCodeBench 72.0%. Это данные разработчика модели; фактическая скорость API зависит от длины контекста, режима рассуждения и объёма ответа. Gemini 3.1 Flash-Lite стоит выбирать, когда важны низкая цена, высокая пропускная способность и мультимодальность. Для наиболее сложного программирования или задач, где приоритетом является максимальная точность рассуждений, лучше сравнить её с более мощными моделями каталога.
Gemini 3 Flash Preview
Gemini 3 Flash Preview API: предыдущая preview-модель Gemini. Для быстрых мультимодальных задач и совместимых сценариев.
Gemini 3.1 Flash-Lite Image
Nano Banana 2 Lite API (Gemini 3.1 Flash-Lite Image) в России: быстрая генерация и редактирование изображений 1K по цене $0.020 за успешную генерацию.
Gemini 3.5 Flash
Gemini 3.5 Flash API: текущая стабильная высокопроизводительная модель Gemini. Для агентных задач, программирования, мультимодального анализа и длинных рабочих процессов.