Ключевые данные
- Провайдер
- Qwen
- Идентификатор
- qwen3.7-max
- Контекст
- 1M
- Лимит ответа
- 128K
- Единица цены
- За 1 млн токенов
Qwen
Qwen3.7 Max — флагманская reasoning-LLM для сложного кода, аналитики и агентных задач с контекстом до 1M.
Идентификатор модели в API NeuroAPI
qwen3.7-maxВозможности модели
Возможности показаны по текущим данным каталога NeuroAPI. Фактическая скорость зависит от объёма контекста и нагрузки.
текст
текст
Пример запроса
Отправьте первый запрос к qwen3.7-max через OpenAI-совместимый endpoint NeuroAPI. Подробнее — в разделе документации.
curl --location 'https://neuroapi.host/v1/chat/completions' \
--header 'Authorization: Bearer NEUROAPI_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "qwen3.7-max",
"messages": [
{ "role": "user", "content": "Привет! Напиши короткое приветственное сообщение для нового пользователя." }
]
}'Простое текстовое сообщение — самый короткий путь к первому ответу модели.
Подробнее в документацииФакты из каталога
Проверяемые данные
Название, доступность, возможности и единицы тарификации берутся из текущего публичного каталога NeuroAPI. Цена зависит от выбранной модели и тарифа, поэтому перед интеграцией сверяйте карточку и каталог.
Цена
| Тариф | Входящие токены | Исходящие токены | Контекст |
|---|---|---|---|
Пилот экономичный | 124,25 ₽ | 372,76 ₽ | 256000 |
Оптимальный официальные API | 232,20 ₽ | 696,60 ₽ | 1000000 |
Итоговая стоимость зависит от тарифа и фактического объёма запросов.
Создать API-ключПодробности
Qwen3.7 Max — флагманская LLM семейства Qwen для сложного программирования, аналитики и длительных агентных задач. В NeuroAPI модель вызывается по идентификатору `qwen3.7-max` через OpenAI-совместимые Chat Completions и Responses API: формат ответа соответствует формату входного запроса клиента. ## Возможности - текстовый контекст до 1 млн токенов на тарифе «Оптимальный»; - thinking/reasoning, streaming, function calling и структурированный JSON; - до 131 072 токенов выходного текста согласно публичному лимиту провайдера; - контекстное кеширование повторяющихся префиксов для снижения задержки и стоимости. ## Когда выбирать Модель подходит для архитектуры ПО, анализа больших репозиториев, сложного рефакторинга, исследовательских задач, длинных документов и агентов с инструментами. Для массовых простых запросов Qwen3.7 Plus или Flash обычно экономичнее. ## Цена и ограничения Входные и выходные токены оплачиваются отдельно; thinking-токены входят в выходное потребление. Актуальная стоимость отображается в каталоге NeuroAPI. Результаты могут содержать фактические и логические ошибки, поэтому критические решения и исполняемый код требуют проверки.
Qwen3.6 35B A3B
Qwen3.6 35B A3B — эффективная MoE-модель для текста, изображений, видео, кода и reasoning с контекстом 256K.
Qwen3.6 Flash
Qwen3.6 Flash — быстрая мультимодальная модель для ассистентов, извлечения данных и визуального анализа.
Qwen3.7 Plus
Qwen3.7 Plus — мультимодальная LLM для production-ассистентов, кода и инструментов с контекстом до 1M.