Ключевые данные
- Провайдер
- Qwen
- Идентификатор
- qwen3.6-flash
- Контекст
- 1M
- Лимит ответа
- 64K
- Единица цены
- За 1 млн токенов
- Тарифные tiers
- 256000+: ×4
Qwen
Qwen3.6 Flash — быстрая мультимодальная модель для ассистентов, извлечения данных и визуального анализа.
Идентификатор модели в API NeuroAPI
qwen3.6-flashВозможности модели
Возможности показаны по текущим данным каталога NeuroAPI. Фактическая скорость зависит от объёма контекста и нагрузки.
текст, изображения, файлы
текст
Пример запроса
Отправьте первый запрос к qwen3.6-flash через OpenAI-совместимый endpoint NeuroAPI. Подробнее — в разделе документации.
curl --location 'https://neuroapi.host/v1/chat/completions' \
--header 'Authorization: Bearer NEUROAPI_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "qwen3.6-flash",
"messages": [
{ "role": "user", "content": "Привет! Напиши короткое приветственное сообщение для нового пользователя." }
]
}'Простое текстовое сообщение — самый короткий путь к первому ответу модели.
Подробнее в документацииФакты из каталога
Проверяемые данные
Название, доступность, возможности и единицы тарификации берутся из текущего публичного каталога NeuroAPI. Цена зависит от выбранной модели и тарифа, поэтому перед интеграцией сверяйте карточку и каталог.
Цена
| Тариф | Входящие токены | Исходящие токены | Контекст |
|---|---|---|---|
Пилот экономичный | 15,80 ₽ | 94,77 ₽ | 1M |
Оптимальный официальные API | 29,52 ₽ | 177,10 ₽ | 1000000 |
Объёмные скидки (tiers)
| От объёма | Вход × | Выход × |
|---|---|---|
| 256000 | 4 | 2.666666666666667 |
Итоговая стоимость зависит от тарифа и фактического объёма запросов.
Создать API-ключПодробности
Qwen3.6 Flash — быстрая мультимодальная модель Qwen для массового production-трафика. Идентификатор `qwen3.6-flash` работает через OpenAI-совместимые Chat Completions и Responses API NeuroAPI. ## Возможности - текст, изображения и видео на входе; текст на выходе; - контекст до 1 млн токенов, выход до 65 536 токенов; - reasoning, streaming, вызов функций и структурированный вывод; - кеширование общего начала запросов. ## Сценарии Используйте модель для быстрых ассистентов, визуального анализа, извлечения данных, классификации, суммаризации, модерации и недорогих агентных шагов. Для наиболее сложного кода и длинных автономных задач предпочтительнее линейка 3.7 Plus/Max. ## Цена и ограничения Свыше 256K входных токенов действует повышенный ценовой уровень для всего запроса; актуальная стоимость отображается в каталоге NeuroAPI. Модель может ошибаться в деталях изображения, фактах и расчётах.
Qwen3.7 Plus
Qwen3.7 Plus — мультимодальная LLM для production-ассистентов, кода и инструментов с контекстом до 1M.
Qwen3.7 Flash
Qwen3.7 Flash — быстрая мультимодальная LLM для массовых запросов, изображений и видео с контекстом до 1M.
Qwen3.6 Plus
Qwen3.6 Plus — универсальная текстовая LLM для RAG, кода, документов и агентов с контекстом до 1M.