Цены API Grok 4.5: расчёт стоимости и сравнение моделей
Проверенные цены API Grok 4.5 на июль 2026 года: кэш и длинный контекст, примеры месячных расходов, сравнение с GPT-5.5, Claude Opus 4.8 и Fable 5.
Grok 4.5 стоит $2 за миллион входных и $6 за миллион выходных токенов, пока промпт короче 200 тыс. токенов. Кэшированный вход стоит $0,30. При достижении 200 тыс. токенов SpaceXAI применяет тариф длинного контекста: $4 за вход, $0,60 за кэшированный вход и $12 за выход.
Порог важен: популярная формула «$2/$6» верна, но описывает не весь тариф. Ниже используются данные актуальной страницы цен SpaceXAI, проверенные 23 июля 2026 года.
Возможности и бенчмарки разобраны в статье Grok 4.5 для программирования. Обзор семейства моделей — в материале Что такое Grok.
Официальные тарифы API Grok 4.5
Цены в долларах США за один миллион токенов:
| Тип запроса | Вход | Кэшированный вход | Выход |
|---|---|---|---|
| Промпт короче 200 тыс. | $2,00 | $0,30 | $6,00 |
| Промпт от 200 тыс. | $4,00 | $0,60 | $12,00 |
Документация Grok 4.5 указывает контекст 500 тыс. токенов, границу знаний 1 февраля 2026 года и уровни рассуждения low, medium и high. Модель принимает текст и изображения, а возвращает текст.
Серверные инструменты могут тарифицироваться отдельно. Web Search, X Search, исполнение кода и другие вызовы нужно включать в производственный бюджет.
Сравнение цен флагманских API
В таблице — стандартные глобальные тарифы без Batch, кэша, инструментов, приоритетной обработки и надбавок за региональное размещение:
| Модель | Вход / 1 млн | Выход / 1 млн | Контекст по данным поставщика |
|---|---|---|---|
| Grok 4.5 | $2 | $6 | 500 тыс. |
| Claude Opus 4.8 | $5 | $25 | 1 млн |
| GPT-5.5 | $5 | $30 | 1 млн |
| Claude Fable 5 | $10 | $50 | 1 млн |
Источники: SpaceXAI, OpenAI и Anthropic.
По короткому контексту вход Grok 4.5 на 60% дешевле Opus 4.8 и GPT-5.5. Выход дешевле на 76% и 80% соответственно. Это сравнение тарифов, а не утверждение о равном качестве.
Примеры месячных расходов
100 млн входных и 20 млн выходных токенов
Предположим, каждый промпт короче 200 тыс. токенов, а кэш, инструменты, Batch и повторы отсутствуют:
| Модель | Вход | Выход | Итого в месяц |
|---|---|---|---|
| Grok 4.5 | $200 | $120 | $320 |
| Claude Opus 4.8 | $500 | $500 | $1 000 |
| GPT-5.5 | $500 | $600 | $1 100 |
| Claude Fable 5 | $1 000 | $1 000 | $2 000 |
Формула:
Месячная стоимость = вход × тариф входа + кэш × тариф кэша + выход × тариф выхода
Та же нагрузка с 70% кэшированного входа
Для Grok 4.5: 70 млн кэшированных и 30 млн обычных входных токенов плюс 20 млн выходных:
- обычный вход: 30 × $2 = $60;
- кэшированный вход: 70 × $0,30 = $21;
- выход: 20 × $6 = $120;
- итого $201 без инструментов и повторов.
Экономия относительно варианта без кэша составляет $119. Реальный результат зависит от правил и доли попаданий в кэш.
Длинный контекст
Если промпты пересекают порог 200 тыс., те же 100 млн входных и 20 млн выходных токенов обойдутся в:
- вход: 100 × $4 = $400;
- выход: 20 × $12 = $240;
- итого $640 без кэша и инструментов.
Длинный контекст может окупаться, если предотвращает ошибки поиска и повторные запросы, но это нужно измерять.
Почему тариф за токен — не полная стоимость
Эффективность токенов меняет счёт
SpaceXAI сообщает, что в SWE-Bench Pro Grok 4.5 в среднем использовала 15 954 выходных токена на решённую задачу, а Opus 4.8 max — 67 020, то есть примерно в 4,2 раза больше. Это результат конкретного бенчмарка и конфигурации, а не универсальный коэффициент.
Дешёвая неудача остаётся дорогой
Повторы, вызовы инструментов, тесты и проверка инженером могут превысить стоимость модели. Практичнее считать:
Стоимость принятой задачи = токены + инструменты + повторы + инфраструктура + проверка человеком
У задержки две стороны
SpaceXAI заявляет около 80 токенов в секунду. Независимые измерения зависят от нагрузки: Artificial Analysis сейчас показывает примерно 69,8 токена в секунду и 8,54 секунды до первого токена для протестированной high-reasoning-конфигурации.
Скорость генерации важна для длинных ответов, а первый токен — для чатов и поддержки. Измеряйте обе метрики на своём трафике.
Токенизаторы различаются
Anthropic пишет, что Opus 4.7 и новее, включая Opus 4.8 и Fable 5, используют токенизатор, создающий примерно на 30% больше токенов для того же текста; точное отличие зависит от нагрузки. Одинаковое число токенов удобно для арифметики, но не всегда означает одинаковый объём текста.
Когда Grok 4.5 стоит тестировать
- массовые агенты для кода, ревью и репозиториев;
- исследования и документы с большим выходом;
- задачи с Web Search, X Search или исполнением кода;
- процессы с автоматической проверкой;
- приложения, которым хватает 500 тыс. контекста и где промпты обычно короче 200 тыс.
Осторожность нужна, если критичен первый токен, промпты регулярно длиннее 200 тыс., требуется строгое размещение данных или самые сложные дефекты требуют максимального процента успеха.
Практический план тестирования
- Соберите минимум 50 реальных задач, включая ошибки и крайние случаи.
- Дайте моделям одинаковые инструменты, тайм-ауты и критерии приёмки.
- Запишите обычный и кэшированный вход, выход, инструменты, повторы и время.
- Проведите слепую оценку там, где тестов недостаточно.
- Сравните стоимость принятой задачи и p95 задержки.
- Передавайте рискованные и повторно неудачные задачи более сильной модели или человеку.
Частые вопросы
Сколько стоит API Grok 4.5?
До 200 тыс. токенов в промпте: $2 за миллион входных, $0,30 за миллион кэшированных и $6 за миллион выходных токенов. От 200 тыс. ставки удваиваются: $4, $0,60 и $12.
Grok 4.5 дешевле GPT-5.5?
По стандартным тарифам короткого контекста — да: вход дешевле на 60%, выход на 80%. Реальная экономия зависит от токенизации, успешности, инструментов, кэша и повторов.
Контекст Grok 4.5 действительно 500 тыс. токенов?
Да. Но тариф длинного контекста начинается раньше — с 200 тыс. токенов в промпте.
Web Search и X Search входят в цену токенов?
Не следует так считать. Серверные инструменты могут иметь отдельную тарификацию; проверяйте страницу цен и консоль.
Самая дешёвая модель всегда лучше?
Нет. Сравнивайте стоимость принятой задачи с учётом доработки и проверки, используя собственный тестовый набор.
Источники
- SpaceXAI Developers: Pricing
- SpaceXAI Developers: Grok 4.5
- SpaceXAI: Introducing Grok 4.5
- Cursor: Introducing Grok 4.5
- OpenAI: Introducing GPT-5.5
- Anthropic: Claude API pricing
- Artificial Analysis: Grok 4.5
Цены и измерения проверены 23 июля 2026 года. Тарифы, лимиты и бенчмарки меняются; перед покупкой сверяйтесь с актуальной документацией по ссылкам.