Ключевые данные
- Провайдер
- Qwen
- Идентификатор
- qwen3.7-flash
- Контекст
- 1M
- Лимит ответа
- 64K
- Единица цены
- За 1 млн токенов
- Пороги стоимости токенов
- от 32 001: вход ×3,3333, выход ×3,0769; от 256 001: вход ×6,6667, выход ×6,1538
Qwen
Qwen3.7 Flash — быстрая мультимодальная LLM для массовых запросов, изображений и видео с контекстом до 1M.
Идентификатор модели в API NeuroAPI
qwen3.7-flashВозможности модели
Возможности показаны по текущим данным каталога NeuroAPI. Фактическая скорость зависит от объёма контекста и нагрузки.
текст, изображения, файлы
текст
Пример запроса
Отправьте первый запрос к qwen3.7-flash через OpenAI-совместимый endpoint NeuroAPI. Подробнее — в разделе документации.
curl --location 'https://neuroapi.host/v1/chat/completions' \
--header 'Authorization: Bearer NEUROAPI_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "qwen3.7-flash",
"messages": [
{ "role": "user", "content": "Привет! Напиши короткое приветственное сообщение для нового пользователя." }
]
}'Простое текстовое сообщение — самый короткий путь к первому ответу модели.
Подробнее в документацииФакты из каталога
Проверяемые данные
Название, доступность, возможности и единицы тарификации берутся из текущего публичного каталога NeuroAPI. Цена зависит от выбранной модели и тарифа, поэтому перед интеграцией сверяйте карточку и каталог.
Цена
Оптимальный
Цена: вход 5,0142 ₽ · выход 21,7283 ₽
Вход из кэша: 1,0028 ₽
За 1 млн токенов
Базовая ставка: до 32 000 входных токенов включительно.
Длинный контекст от 32 001 входных токенов
Вход 16,7141 ₽ (×3,3333) · выход 66,8564 ₽ (×3,0769)
Длинный контекст от 256 001 входных токенов
Вход 33,4282 ₽ (×6,6667) · выход 133,7128 ₽ (×6,1538)
Цена кэша применяется только к подтверждённым кэшированным входным токенам; попадание в кэш не гарантируется.
Проведите по таблице влево, чтобы увидеть все столбцы.
| Тариф | Входящие токены | Исходящие токены | Контекст |
|---|---|---|---|
Оптимальный официальные API | 5,01 ₽ | 21,73 ₽ | 1000000 |
Коэффициенты для длинного контекста
Базовые цены выше действуют до 32 000 входных токенов включительно. После перехода на следующую ступень её коэффициенты применяются ко всем токенам запроса.
Проведите по таблице влево, чтобы увидеть все коэффициенты.
| Диапазон входа | Коэффициент входа | Коэффициент выхода |
|---|---|---|
| от 32 001 токенов | ×3,3333 | ×3,0769 |
| от 256 001 токенов | ×6,6667 | ×6,1538 |
Итоговая стоимость зависит от тарифа и фактического объёма запросов.
Создать API-ключПодробности
Qwen3.7 Flash — быстрая и недорогая мультимодальная модель Qwen для высоконагруженных приложений. Используйте ID `qwen3.7-flash` через Chat Completions или Responses API NeuroAPI.\n\n## Возможности\n\n- текст, изображения и видеофрагменты на входе; текст на выходе;\n- контекст до 1 млн токенов, выход до 65 536 токенов;\n- reasoning, streaming, function calling и JSON/structured output;\n- контекстное кеширование для повторяющихся системных инструкций и общей истории.\n\n## Когда выбирать\n\nFlash полезна для чат-ботов, классификации, извлечения данных, модерации, кратких ответов, визуального анализа и массовых фоновых задач, где важны низкая задержка и предсказуемая стоимость.\n\n## Цена и ограничения\n\nДля входа свыше 32K и 256K применяются отдельные ценовые уровни; актуальная стоимость отображается в каталоге NeuroAPI. Сложные многошаговые задачи могут потребовать Plus или Max; ответы необходимо проверять.
qwen3.7-max
Qwen3.7 Max — флагманская reasoning-LLM для сложного кода, аналитики и агентных задач с контекстом до 1M.
qwen3.7-plus
Qwen3.7 Plus — мультимодальная LLM для production-ассистентов, кода и инструментов с контекстом до 1M.
qwen3.6-plus
Qwen3.6 Plus — универсальная текстовая LLM для RAG, кода, документов и агентов с контекстом до 1M.