Ключевые данные
- Провайдер
- Qwen
- Идентификатор
- qwen3.6-flash
- Контекст
- 1M
- Лимит ответа
- 64K
- Единица цены
- За 1 млн токенов
- Пороги стоимости токенов
- от 256 001: вход ×4, выход ×2,6667
Qwen
Qwen3.6 Flash — быстрая мультимодальная модель для ассистентов, извлечения данных и визуального анализа.
Идентификатор модели в API NeuroAPI
qwen3.6-flashВозможности модели
Возможности показаны по текущим данным каталога NeuroAPI. Фактическая скорость зависит от объёма контекста и нагрузки.
текст, изображения, файлы
текст
Пример запроса
Отправьте первый запрос к qwen3.6-flash через OpenAI-совместимый endpoint NeuroAPI. Подробнее — в разделе документации.
curl --location 'https://neuroapi.host/v1/chat/completions' \
--header 'Authorization: Bearer NEUROAPI_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "qwen3.6-flash",
"messages": [
{ "role": "user", "content": "Привет! Напиши короткое приветственное сообщение для нового пользователя." }
]
}'Простое текстовое сообщение — самый короткий путь к первому ответу модели.
Подробнее в документацииФакты из каталога
Проверяемые данные
Название, доступность, возможности и единицы тарификации берутся из текущего публичного каталога NeuroAPI. Цена зависит от выбранной модели и тарифа, поэтому перед интеграцией сверяйте карточку и каталог.
Цена
Оптимальный
Цена: вход 31,3389 ₽ · выход 188,0336 ₽
Вход из кэша: 6,2678 ₽
За 1 млн токенов
Базовая ставка: до 256 000 входных токенов включительно.
Длинный контекст от 256 001 входных токенов
Вход 125,3558 ₽ (×4) · выход 501,423 ₽ (×2,6667)
Цена кэша применяется только к подтверждённым кэшированным входным токенам; попадание в кэш не гарантируется.
Проведите по таблице влево, чтобы увидеть все столбцы.
| Тариф | Входящие токены | Исходящие токены | Контекст |
|---|---|---|---|
Оптимальный официальные API | 31,34 ₽ | 188,03 ₽ | 1000000 |
Коэффициенты для длинного контекста
Базовые цены выше действуют до 256 000 входных токенов включительно. После перехода на следующую ступень её коэффициенты применяются ко всем токенам запроса.
Проведите по таблице влево, чтобы увидеть все коэффициенты.
| Диапазон входа | Коэффициент входа | Коэффициент выхода |
|---|---|---|
| от 256 001 токенов | ×4 | ×2,6667 |
Итоговая стоимость зависит от тарифа и фактического объёма запросов.
Создать API-ключПодробности
Qwen3.6 Flash — быстрая мультимодальная модель Qwen для массового production-трафика. Идентификатор `qwen3.6-flash` работает через OpenAI-совместимые Chat Completions и Responses API NeuroAPI.\n\n## Возможности\n\n- текст, изображения и видео на входе; текст на выходе;\n- контекст до 1 млн токенов, выход до 65 536 токенов;\n- reasoning, streaming, вызов функций и структурированный вывод;\n- кеширование общего начала запросов.\n\n## Сценарии\n\nИспользуйте модель для быстрых ассистентов, визуального анализа, извлечения данных, классификации, суммаризации, модерации и недорогих агентных шагов. Для наиболее сложного кода и длинных автономных задач предпочтительнее линейка 3.7 Plus/Max.\n\n## Цена и ограничения\n\nСвыше 256K входных токенов действует повышенный ценовой уровень для всего запроса; актуальная стоимость отображается в каталоге NeuroAPI. Модель может ошибаться в деталях изображения, фактах и расчётах.
qwen3.7-plus
Qwen3.7 Plus — мультимодальная LLM для production-ассистентов, кода и инструментов с контекстом до 1M.
qwen3.6-35b-a3b
Qwen3.6 35B A3B — эффективная MoE-модель для текста, изображений, видео, кода и reasoning с контекстом 256K.
qwen3.7-max
Qwen3.7 Max — флагманская reasoning-LLM для сложного кода, аналитики и агентных задач с контекстом до 1M.