Ключевые данные
- Провайдер
- Alibaba
- Идентификатор
- qwen3.8-max
- Контекст
- 1M
- Лимит ответа
- 131K
- Единица цены
- За 1 млн токенов
Alibaba
Qwen3.8 Max — флагманская мультимодальная MoE-модель на 2,4 трлн параметров для сложного кода, долгих агентных задач и профессиональной работы.
Идентификатор модели в API NeuroAPI
qwen3.8-maxВозможности модели
Возможности показаны по текущим данным каталога NeuroAPI. Фактическая скорость зависит от объёма контекста и нагрузки.
текст, изображения
текст
Пример запроса
Отправьте первый запрос к qwen3.8-max через OpenAI-совместимый endpoint NeuroAPI. Подробнее — в разделе документации.
curl --location 'https://neuroapi.host/v1/chat/completions' \
--header 'Authorization: Bearer NEUROAPI_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "qwen3.8-max",
"messages": [
{ "role": "user", "content": "Привет! Напиши короткое приветственное сообщение для нового пользователя." }
]
}'Простое текстовое сообщение — самый короткий путь к первому ответу модели.
Подробнее в документацииФакты из каталога
Проверяемые данные
Название, доступность, возможности и единицы тарификации берутся из текущего публичного каталога NeuroAPI. Цена зависит от выбранной модели и тарифа, поэтому перед интеграцией сверяйте карточку и каталог.
Цена
| Тариф | Входящие токены | Исходящие токены | Контекст |
|---|---|---|---|
Пилот экономичный | 129,60 ₽ | 388,80 ₽ | 1M |
Оптимальный официальные API | 242,19 ₽ | 726,57 ₽ | 1000000 |
Точное сопоставление модели, без усреднения цен.
Итоговая стоимость зависит от тарифа и фактического объёма запросов.
Создать API-ключПодробности
Qwen3.8 Max — флагманская мультимодальная модель Qwen на архитектуре Mixture-of-Experts с 2,4 трлн параметров. Она рассчитана на сложное программирование, длительные агентные процессы и профессиональные задачи, где требуется планирование, многократная проверка результата и работа с большим объёмом контекста. Идентификатор API: `qwen3.8-max`. ## Возможности - текст, изображения и видео на входе; текст на выходе; - контекст до 1 млн токенов, до 991 тыс. входных и до 131 тыс. выходных токенов; - расширенное reasoning-мышление для многошаговых задач; - streaming, function calling и структурированный JSON; - Chat Completions и Responses API в OpenAI-совместимом формате; - контекстное кеширование повторяющихся префиксов для снижения задержки и стоимости. ## Когда выбирать Модель подходит для анализа крупных репозиториев и длинных документов, full-stack разработки, архитектуры и рефакторинга, финансовой и юридической аналитики, проектирования интерфейсов, обработки сложных изображений и видео, а также агентов, которые планируют работу и вызывают клиентские инструменты. ## Ограничения Reasoning-токены входят в выходное потребление. Чем длиннее контекст и сложнее задача, тем выше задержка и итоговый расход токенов. Ответы, расчёты, юридические выводы и сгенерированный код необходимо проверять перед использованием в критических процессах. Доступные функции зависят от выбранного API-формата и параметров запроса.
Qwen 3.5 Omni Plus
Qwen 3.5 Omni Plus — флагманская мультимодальная модель для текста, изображений, аудио и видео
Qwen 3.5 Omni Flash
Qwen 3.5 Omni Flash — быстрая мультимодальная модель для текста, изображений, аудио и видео
Qwen3 Omni Flash
Qwen3 Omni Flash — мультимодальная модель с режимом рассуждений и голосовым ответом