Ключевые данные
- Провайдер
- Qwen
- Идентификатор
- qwen3.7-flash
- Контекст
- 1M
- Лимит ответа
- 64K
- Единица цены
- За 1 млн токенов
- Тарифные tiers
- 32000+: ×3.333333333333333, 256000+: ×6.666666666666667
Qwen
Qwen3.7 Flash — быстрая мультимодальная LLM для массовых запросов, изображений и видео с контекстом до 1M.
Идентификатор модели в API NeuroAPI
qwen3.7-flashВозможности модели
Возможности показаны по текущим данным каталога NeuroAPI. Фактическая скорость зависит от объёма контекста и нагрузки.
текст, изображения, файлы
текст
Пример запроса
Отправьте первый запрос к qwen3.7-flash через OpenAI-совместимый endpoint NeuroAPI. Подробнее — в разделе документации.
curl --location 'https://neuroapi.host/v1/chat/completions' \
--header 'Authorization: Bearer NEUROAPI_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "qwen3.7-flash",
"messages": [
{ "role": "user", "content": "Привет! Напиши короткое приветственное сообщение для нового пользователя." }
]
}'Простое текстовое сообщение — самый короткий путь к первому ответу модели.
Подробнее в документацииФакты из каталога
Проверяемые данные
Название, доступность, возможности и единицы тарификации берутся из текущего публичного каталога NeuroAPI. Цена зависит от выбранной модели и тарифа, поэтому перед интеграцией сверяйте карточку и каталог.
Цена
| Тариф | Входящие токены | Исходящие токены | Контекст |
|---|---|---|---|
Пилот экономичный | 2,53 ₽ | 10,95 ₽ | 1M |
Оптимальный официальные API | 4,72 ₽ | 20,47 ₽ | 1000000 |
Объёмные скидки (tiers)
| От объёма | Вход × | Выход × |
|---|---|---|
| 32000 | 3.333333333333333 | 3.076923076923077 |
| 256000 | 6.666666666666667 | 6.153846153846154 |
Итоговая стоимость зависит от тарифа и фактического объёма запросов.
Создать API-ключПодробности
Qwen3.7 Flash — быстрая и недорогая мультимодальная модель Qwen для высоконагруженных приложений. Используйте ID `qwen3.7-flash` через Chat Completions или Responses API NeuroAPI. ## Возможности - текст, изображения и видеофрагменты на входе; текст на выходе; - контекст до 1 млн токенов, выход до 65 536 токенов; - reasoning, streaming, function calling и JSON/structured output; - контекстное кеширование для повторяющихся системных инструкций и общей истории. ## Когда выбирать Flash полезна для чат-ботов, классификации, извлечения данных, модерации, кратких ответов, визуального анализа и массовых фоновых задач, где важны низкая задержка и предсказуемая стоимость. ## Цена и ограничения Для входа свыше 32K и 256K применяются отдельные ценовые уровни; актуальная стоимость отображается в каталоге NeuroAPI. Сложные многошаговые задачи могут потребовать Plus или Max; ответы необходимо проверять.
Qwen3.7 Plus
Qwen3.7 Plus — мультимодальная LLM для production-ассистентов, кода и инструментов с контекстом до 1M.
Qwen3.6 Plus
Qwen3.6 Plus — универсальная текстовая LLM для RAG, кода, документов и агентов с контекстом до 1M.
Qwen3.7 Max
Qwen3.7 Max — флагманская reasoning-LLM для сложного кода, аналитики и агентных задач с контекстом до 1M.