КомпаниямБонусыЦеныДокументацияНовости
МенюЗакрыть
КомпаниямБонусыЦеныДокументацияНовостиВойти
RU
Войти
Модели и цены/Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite

Google

Gemini 3.1 Flash-Lite API в России: быстрая мультимодальная модель Google для больших документов и массовых задач от $0.25 за 1 млн входных токенов.

Идентификатор модели в API NeuroAPI

gemini-3.1-flash-lite
Создать ключ и попробоватьПример запросаСравнить модель

Пилот

экономичный

Входящие

16,20 ₽

Исходящие

97,20 ₽

Оптимальный

официальные API

Входящие

30,27 ₽

Исходящие

181,64 ₽

За 1 млн токенов

Оплата по тарифу успешной попытки

Подробнее о цене

Возможности модели

Главное для выбора

Возможности показаны по текущим данным каталога NeuroAPI. Фактическая скорость зависит от объёма контекста и нагрузки.

Максимальный контекст
1M
По данным каталога модели
Максимальный ответ
65K
Лимит выходных токенов
Уровень модели
Средний
Скорость: средняя
Срез знаний
Январь 2025 г.
По данным каталога модели

Принимает

текст, изображения, аудио, файлы

Возвращает

текст

API-возможности

  • Потоковая выдача
  • Вызов функций
  • Структурированный вывод
  • Управляемое мышление

Пример запроса

Подключение за пару минут

Отправьте первый запрос к gemini-3.1-flash-lite через OpenAI-совместимый endpoint NeuroAPI. Подробнее — в разделе документации.

curl --location 'https://neuroapi.host/v1/chat/completions' \
--header 'Authorization: Bearer NEUROAPI_KEY' \
--header 'Content-Type: application/json' \
--data '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    { "role": "user", "content": "Привет! Напиши короткое приветственное сообщение для нового пользователя." }
  ]
}'

Простое текстовое сообщение — самый короткий путь к первому ответу модели.

Подробнее в документации→

Факты из каталога

Что известно о модели Gemini 3.1 Flash-Lite

Ключевые данные

Провайдер
Google
Идентификатор
gemini-3.1-flash-lite
Контекст
1M
Лимит ответа
65K
Срез знаний
Январь 2025 г.
Единица цены
За 1 млн токенов

Возможности API

  • Потоковая выдача: Да
  • Вызов функций: Да
  • Структурированный вывод: Да
  • Управляемое мышление: Да

Ограничения каталога

  • Каталожные характеристики не заменяют собственную проверку модели на ваших данных.
  • Цена и доступность могут меняться; перед интеграцией сверяйте карточку с актуальным каталогом.

Проверяемые данные

Как читать карточку модели

Название, доступность, возможности и единицы тарификации берутся из текущего публичного каталога NeuroAPI. Цена зависит от выбранной модели и тарифа, поэтому перед интеграцией сверяйте карточку и каталог.

Источники и методологияКак обновляются цены и доступностьОбработка данныхГраница NeuroAPI и провайдера моделиСовместимость APIЧто проверить перед миграциейСравнить моделиЦена, контекст и возможности

Цена

Стоимость и тарифы

ТарифВходящие токеныИсходящие токеныКонтекст

Пилот

экономичный

16,20 ₽97,20 ₽256000

Оптимальный

официальные API

30,27 ₽181,64 ₽1M
За 1 млн токенов

Итоговая стоимость зависит от тарифа и фактического объёма запросов.

Создать API-ключ

Подробности

О модели Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite — быстрая и экономичная мультимодальная модель Google для приложений с большим потоком запросов. Через API NeuroAPI она доступна по официальному идентификатору `gemini-3.1-flash-lite` с оплатой в рублях. Стоимость составляет $0.25 за 1 млн входных текстовых токенов и $1.50 за 1 млн выходных токенов. ## Возможности Gemini 3.1 Flash-Lite Модель принимает текст, изображения, аудио и документы, а возвращает текст. Она поддерживает потоковую генерацию, вызов функций, структурированный JSON-ответ и управляемое рассуждение. Официальное контекстное окно модели достигает 1 048 576 токенов, максимальный ответ — 65 536 токенов. Для тарифов «Пилот» и «Оптимальный» действует лимит 256 000 токенов на запрос: его достаточно для анализа больших документов, длинных диалогов и крупных наборов данных без дробления на короткие фрагменты. ## Для каких задач подходит - чат-боты и автоматизация службы поддержки; - извлечение данных, классификация, разметка и модерация контента; - суммаризация договоров, отчётов, исследований и PDF-документов; - перевод и обработка многоязычных текстов; - анализ изображений и аудио вместе с текстовым контекстом; - RAG, function calling и лёгкие AI-агенты; - массовая генерация описаний, ответов и структурированных данных. ## Скорость и бенчмарки В опубликованной Google DeepMind карточке модели за март 2026 года Gemini 3.1 Flash-Lite показала 363 токена в секунду против 249 у Gemini 2.5 Flash. Там же указаны результаты GPQA Diamond 86.9%, MMMU-Pro 76.8%, Video-MMMU 84.8% и LiveCodeBench 72.0%. Это данные разработчика модели; фактическая скорость API зависит от длины контекста, режима рассуждения и объёма ответа. Gemini 3.1 Flash-Lite стоит выбирать, когда важны низкая цена, высокая пропускная способность и мультимодальность. Для наиболее сложного программирования или задач, где приоритетом является максимальная точность рассуждений, лучше сравнить её с более мощными моделями каталога.

Что учитывать

  • Потоковая выдача доступна, но фактическая скорость зависит от нагрузки и длины запроса.
  • Поддержка вызова функций полезна для интеграций, где нужен машинно-обрабатываемый ответ.
  • Структурированный вывод помогает, если ответ должен совпадать с ожидаемой схемой.
  • Каталожные характеристики не заменяют собственную проверку модели.

Характеристики отражают данные текущего каталога NeuroAPI и не являются обещанием фиксированной задержки, качества результата или доступности.

Другие модели Google

Gemini 3 Flash Preview

Gemini 3 Flash Preview API: предыдущая preview-модель Gemini. Для быстрых мультимодальных задач и совместимых сценариев.

Gemini 3.1 Flash-Lite Image

Nano Banana 2 Lite API (Gemini 3.1 Flash-Lite Image) в России: быстрая генерация и редактирование изображений 1K по цене $0.020 за успешную генерацию.

Gemini 3.5 Flash

Gemini 3.5 Flash API: текущая стабильная высокопроизводительная модель Gemini. Для агентных задач, программирования, мультимодального анализа и длинных рабочих процессов.

Продукт
  • API ключи
  • OpenAI API
  • Claude API
  • Gemini API
  • DeepSeek API
  • Qwen API
  • Video API
  • Модели и цены
  • Для бизнеса
  • Сравнение моделей
  • Реферальная программа
Разработчикам
  • Быстрый старт
  • Форматы API
  • Примеры кода
  • Аутентификация
  • Цены
  • Ошибки
Компания
  • О нас
  • Реквизиты
Поддержка
  • Центр поддержки
  • Сообщество
  • Telegram
Гайды
  • Методология
  • API для бизнеса в России
  • Обработка данных
  • OpenAI-compatible API
  • Подключение Codex CLI
  • Подключение Claude Code
НейроАПИ
ООО «Эмпатра» · ИНН 3849110584 · ОГРН 1253800016370
664019, Иркутская область, г. Иркутск, ул. Освобождения, д. 131/1
work@empatra.ai
Публичная офертаПолитика обработки персональных данныхСогласие на обработку персональных данныхРеквизиты
© 2026 НейроАПИ. Все права защищены.
Главная
Новости
Войти
Цены
Документация