GPT-5.6 Luna — младшая и самая доступная модель семейства GPT-5.6. Она рассчитана на высоконагруженные приложения, где важны низкая стоимость одного запроса, современное reasoning и совместимость с теми же API-инструментами, что у старших моделей.
Несмотря на экономичный уровень, Luna принимает текст и изображения, поддерживает reasoning tokens, streaming, function calling и structured outputs. Контекстное окно составляет 1 050 000 токенов, максимальный ответ — 128 000 токенов, официальный knowledge cutoff — 16 февраля 2026 года.
Luna подходит для случаев, когда запросов много и стоимость важнее максимального результата на самых сложных задачах. Проверить характеристики и доступность можно в [карточке GPT-5.6 Luna](/model/gpt-5.6-luna).
Для более сложного программирования и аналитики подойдёт [GPT-5.6 Terra](/model/gpt-5.6-terra), а для наиболее ответственных агентных задач — [GPT-5.6 Sol](/model/gpt-5.6-sol).
OpenAI установила базовую цену $1 за 1 млн входных токенов, $0,10 за 1 млн кешированных входных токенов и $6 за 1 млн выходных токенов. Явная запись кеша тарифицируется по ставке 1,25 от обычного input.
При входе больше 272 000 токенов включается long-context тарификация: весь вход стоит в 2 раза дороже, весь выход — в 1,5 раза дороже. Даже для бюджетной модели длинный контекст необходимо учитывать отдельно при прогнозировании расходов.
Цены, лимиты и поддерживаемые функции приведены в официальной документации GPT-5.6 Luna.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_NEUROAPI_KEY",
base_url="https://neuroapi.host/v1",
)
response = client.chat.completions.create(
model="gpt-5.6-luna",
messages=[
{"role": "user", "content": "Определи тему обращения и верни JSON."}
],
)
print(response.choices[0].message.content)Модель можно вызывать и через Responses API. Для массовой обработки используйте ограничение параллелизма, повтор только безопасных ошибок и собственные проверки формата результата.
Задержка зависит не только от модели, но и от конкретного upstream-маршрута. В проверках NeuroAPI Luna отвечала быстро через UniAPI, тогда как один из альтернативных маршрутов выполнял даже короткий тест несколько минут. Поэтому нестабильный маршрут не был оставлен в тестовом тарифе, а рабочий коммерческий доступ сохранён.
Это важный production-принцип: наличие идентификатора в /v1/models ещё не гарантирует одинаковую скорость у разных поставщиков. NeuroAPI проверяет маршруты отдельно и не публикует заведомо нестабильный путь как основной.
Начните с Luna, если у вас большой поток однотипных запросов и результат легко проверить автоматически. Если качество на сложных примерах недостаточно, перенаправляйте только такие случаи на Terra или Sol. Каскадная схема обычно дешевле, чем использование флагманской модели для каждого запроса.
Актуальная доступность и цена показаны на странице [GPT-5.6 Luna API в NeuroAPI](/model/gpt-5.6-luna).

Из каталога NeuroAPI удалены 10 моделей OpenAI и Google с завершённой поддержкой или объявленной датой отключения. Публикуем полный список и доступные модели для миграции.

Обзор Grok 4.5: программирование, агентные инструменты, reasoning, контекст 500 тыс. токенов, официальная цена и запуск через API NeuroAPI.

Claude Fable 5 для долгих агентных сценариев, исследований и программирования: контекст 1 млн токенов, always-on reasoning, цена и доступ через NeuroAPI.