Grok 4.5 — новая флагманская модель xAI для программирования, агентных задач и интеллектуальной работы. Она поддерживает управляемое reasoning и доступна через Responses API и Chat Completions, поэтому её можно подключать к существующим OpenAI-совместимым приложениям.
xAI позиционирует Grok 4.5 как основную модель для кода, инженерии, науки и knowledge work. Она принимает текст и изображения, возвращает текст, вызывает функции и поддерживает серверные инструменты: веб-поиск, поиск по X и выполнение кода.
Контекстное окно составляет 500 000 токенов. Reasoning настраивается уровнями low, medium и high; по умолчанию используется high. Это позволяет снижать задержку на простых запросах и сохранять глубокое рассуждение для сложной разработки и аналитики.
Параметры модели и тарифы NeuroAPI доступны в [карточке Grok 4.5](/model/grok-4.5).
В анонсе xAI заявлена скорость около 80 выходных токенов в секунду. Реальная задержка зависит от reasoning effort, длины ответа, загрузки провайдера и используемых инструментов.
Стандартная ставка xAI — $2 за 1 млн входных токенов и $6 за 1 млн выходных токенов. Кешированный input стоит дешевле обычного; для надёжных cache hit xAI рекомендует задавать prompt_cache_key в Responses API или заголовок x-grok-conv-id в Chat Completions.
В официальной документации Grok 4.5 не заявлен отдельный ценовой порог для длинного контекста. Дополнительная плата может возникать за серверные инструменты, поэтому веб-поиск и выполнение кода следует учитывать отдельно от токенов.
Текущие характеристики опубликованы на официальной странице Grok 4.5, а контекст и сравнение моделей — в каталоге xAI.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_NEUROAPI_KEY",
base_url="https://neuroapi.host/v1",
)
response = client.responses.create(
model="grok-4.5",
input="Найди ошибку конкурентного доступа в этом коде и предложи исправление.",
reasoning={"effort": "high"},
prompt_cache_key="project-review-session",
)
print(response.output_text)Если используете встроенные инструменты, проверяйте их наличие на выбранном маршруте и обрабатывайте tool calls до получения окончательного текста.
Для классификации, коротких ответов и преобразования данных начните с low. Medium подходит для стандартной разработки и аналитики. High следует оставлять для многошагового кода, сложной математики и задач, где дополнительные reasoning tokens дают измеримый прирост качества.
Одинаковый высокий effort для всех запросов увеличивает задержку и стоимость. Практичная стратегия — выбирать уровень по типу задачи или повышать его только после неудачи более дешёвого режима.
Модель опубликована в NeuroAPI с официальной базовой ценой и отдельной SEO-карточкой. Единый шлюз позволяет использовать Grok рядом с GPT и Claude, сравнивать качество на одинаковых запросах и переключать модель без замены SDK.
Откройте [Grok 4.5 API в каталоге NeuroAPI](/model/grok-4.5), чтобы проверить доступные тарифы и начать работу.

Из каталога NeuroAPI удалены 10 моделей OpenAI и Google с завершённой поддержкой или объявленной датой отключения. Публикуем полный список и доступные модели для миграции.

Claude Fable 5 для долгих агентных сценариев, исследований и программирования: контекст 1 млн токенов, always-on reasoning, цена и доступ через NeuroAPI.

Что изменилось в Claude Sonnet 5: адаптивное мышление, новый токенизатор, окно 1 млн токенов, актуальная цена и пример API-запроса через NeuroAPI.