Вы открываете документацию xAI, планируете бюджет на генерацию контента и сразу упираетесь в две разные метрики. В одном разделе счёт идёт на токены, в другом — на штуки. Если перепутать эндпоинты или отправить текстовый промпт в визуальную модель, лог быстро наполнится ошибками, а счёт за инфраструктуру выйдет за рамки прогноза.
Входящие и исходящие токены в текстовых моделях
Сначала разберёмся с текстом. Языковые модели линейки Grok тарифицируются по объёму обработанных данных. Базовой единицей выступает токен — это минимальная смысловая единица текста, которую нейросеть считывает за один шаг вычислений. Обычно это часть слова или один символ в коде.
Провайдер жёстко разделяет прайс-лист на две категории. Первая — входящие токены. Это ваш промпт, системные инструкции и контекст, который вы передаёте модели. Вторая — исходящие токены, то есть сгенерированный ответ.
Фундаментальное правило экономики Grok API: писать текст всегда дороже, чем читать. На 28.08.2026 стоимость исходящих токенов у всех текстовых моделей превышает стоимость входящих ровно в три раза. Разница в тарифах напрямую диктует архитектуру приложения.
Инверсия нагрузки: как направление текста меняет чек
Разберём пограничные случаи соотношения контекста и ответа. Если вы отправляете гигантский дамп базы данных и просите вернуть короткий JSON с выводами, вы платите мало. Вычислительные мощности уходят на чтение, а оно тарифицируется по базовой ставке.
Если же вы даёте короткую команду написать длинный аналитический отчёт, счётчик крутится на дорогих исходящих токенах. Представим инверсию нагрузки на одном и том же объёме данных. Допустим, суммарный лимит задачи — 1200 токенов.
В первом сценарии вы отправляете 800 токенов на вход и получаете 400 на выход. Во втором сценарии вы даёте 400 токенов промпта, а модель генерирует 800 токенов ответа. Общий объём обработанной информации не изменился.
Но из-за того, что генерация стоит втрое дороже чтения, второй сценарий обойдётся вам значительно дороже.

Визуальные генерации и конфликт метрик
Медийные модели работают иначе. Линейка включает эндпоинты grok-imagine, grok-imagine-2 и grok-imagine-video. Здесь концепция токенов не применяется вообще.
Вы платите за сам факт успешной генерации одной картинки или видеоролика. Это принципиально разные единицы счёта. Применять логику токенов к расчёту стоимости визуального контента нельзя.

Если я отправляю длинный текстовый промпт в визуальную модель и ожидаю списания долей цента за токены, я получаю пробитую дыру в бюджете. Бюджет будет исчерпан после первых десятков вызовов. Визуальные эндпоинты требуют отдельного контура биллинга в вашем приложении.
Доступ к шлюзу и аномалия одинаковых тарифов
Попытка подключиться к xAI напрямую заканчивается на этапе привязки корпоративной карты. Прямой путь требует зарубежных платёжных шлюзов или открытия иностранных юридических лиц. Промежуточные сервисы оплаты часто взимают непрогнозируемые комиссии. Использовать нестандартные схемы маршрутизации трафика для коммерческого продукта мы не рекомендуем — это ломает отказоустойчивость.
Мы решаем эту задачу на уровне API-шлюза. Платформа altrouter предоставляет доступ к моделям с оплатой в рублях. На 28.08.2026 тарифы включают скидку 15 процентов от официальной цены вендора. Вы отправляете запрос на наш адрес, мы перенаправляем его к провайдеру.
У версий есть неочевидная специфика. Модели grok-4.6 и grok-4.5 стоят абсолютно одинаково. Интуитивный подход «чем новее индекс, тем дороже вызов» здесь даёт сбой.
Мы не проводили бенчмарки и не выравнивали качество генерации текста между этими двумя версиями. Выбирать между ними придётся вам на основе прогонов ваших собственных промптов. Финансовой разницы при вызове этих двух эндпоинтов нет, поэтому слепой переход на старшую версию без тестирования лишен смысла.
Расчёт стоимости на пуле из 10 000 задач
Прогнали синтетический тест для оценки бюджета. Мы взяли массив из 10 000 однотипных запросов с фиксированным объёмом контекста. На каждый запрос уходит 800 токенов на вход и 400 токенов на выход.
Суммарный объём потребления для всего пула составил 8 миллионов входящих и 4 миллиона исходящих токенов. Откуда взялись эти цифры? Умножаем 800 токенов промпта на 10 000 задач — получаем 8 миллионов на вход. Умножаем 400 токенов ответа на 10 000 задач — получаем 4 миллиона на выход.
Все цены ниже зафиксированы на 28.08.2026 и уже включают нашу скидку 15 процентов от официальной цены вендора. Температуру и системные промпты мы не выравнивали — на итоговый счёт влияет только длина ответа.
| Модель | Наш вход (за 1 млн) | Наш выход (за 1 млн) | Официально (вход/выход) | Цена пула задач |
|---|---|---|---|---|
| grok-4.6 | $1,70 | $5,10 | $2 / $6 | $34,00 |
| grok-4.5 | $1,70 | $5,10 | $2 / $6 | $34,00 |
| grok-4.3 | $1,0625 | $2,125 | $1,25 / $2,5 | $17,00 |
В этом прогоне наглядно видна математика xAI. Из-за того, что генерация стоит втрое дороже чтения ($5,10 против $1,70 у grok-4.6), именно длина ответа формирует чек. Версия grok-4.3 обходится примерно вдвое дешевле по стоимости исходящих токенов.
Для grok-4.3 математика выглядит иначе. Восемь миллионов на вход по тарифу $1,0625 обойдутся в $8,50. Четыре миллиона на выход по тарифу $2,125 добавят ещё $8,50. Общая сумма составит ровно $17,00.
В результате весь массив задач на grok-4.3 стоил нам $17,00, тогда как на старших версиях мы заплатили $34,00. Выбор конкретной модели напрямую определяет маржинальность вашей фичи.
Если мы вернёмся к нашему мысленному эксперименту с инверсией нагрузки, результаты изменятся. Считаем математику для grok-4.6. Четыре миллиона входящих токенов по тарифу $1,70 дают $6,80. Восемь миллионов исходящих токенов по тарифу $5,10 дают $40,80. Итоговый счёт вырастает до $47,60.
Разница в $13,60 возникает исключительно из-за изменения пропорции контекста и ответа. Общий лимит в 12 миллионов токенов при этом остаётся неизменным.
Интеграция через OpenAI SDK
Эндпоинты Grok полностью совместимы со стандартом OpenAI. Вам не придётся переписывать логику работы с сетью или менять парсеры ответов. Сгенерируйте ключ в панели управления.
Поменяйте base_url — адрес, куда библиотека шлёт запрос — на наш. Ключ передайте стандартным способом. Остальной код не трогайте.
import openai client = openai.OpenAI( api_key="ВАШ_КЛЮЧ", base_url="https://api.altrouter.ai/v1" ) response = client.chat.completions.create( model="grok-4.3", messages=[ {"role": "user", "content": "Сгенерируй отчет по метрикам"} ] ) print(response.choices[0].message.content)
Этот скрипт копируется целиком и работает в любой среде с установленным пакетом OpenAI. Ответ вернётся в привычном формате. Структура массива сообщений остаётся неизменной, вы можете передавать системные инструкции и контекст диалога точно так же, как делали это раньше.
Зависимость от серверов апстрима
Шлюз решает проблему биллинга, но не устраняет архитектурные риски. Наш минус прямой: мы выступаем исключительно как маршрутизатор. Если серверы xAI падают от перегрузки или уходят на техническое обслуживание, доступ к моделям пропадает и у нас.
Мы транслируем ваши запросы в оригинальное API.

Если оригинальный провайдер возвращает ошибку таймаута, altrouter передаст этот статус вашему клиенту. Обработка этих сбоев полностью ложится на ваш код.
Частые вопросы о Grok API
Сколько стоит генерация картинок в Grok?
Модели grok-imagine, grok-imagine-2 и grok-imagine-video тарифицируются за успешную генерацию контента. Токен-метрики текста к ним неприменимы. На 28.08.2026 точные цены за одну генерацию изображения в логах не раскрыты по строкам.
Почему grok-4.6 и grok-4.5 стоят одинаково?
На 28.08.2026 стоимость вызовов для этих моделей совпадает: $1,70 за миллион входящих и $5,10 за миллион исходящих токенов. Это цена со скидкой 15 процентов от официальной цены вендора. Мы не проводили бенчмарки, поэтому выбирать версию вам нужно на основе тестов ваших собственных данных.
Какая модель Grok самая дешёвая?
Среди текстовых моделей на 28.08.2026 самой бюджетной выступает grok-4.3. Её тариф составляет $1,0625 на вход и $2,125 на выход за миллион токенов со скидкой 15 процентов от официальной цены вендора. По стоимости генерации она вдвое дешевле старших версий.
Как настроить API ключ для Grok?
Оригинальный ключ от xAI вам не нужен. Вы получаете токен на платформе маршрутизатора и меняете параметр base_url в вашем OpenAI-совместимом клиенте. Вся остальная бизнес-логика приложения остаётся прежней.
Считайте токены до того, как отправите код в продакшен. Тестируйте младшие версии на рутинных задачах — часто они справляются не хуже, а бюджет экономят вдвое.
Регистрация и ключи для доступа к API:
- [Платформа altrouter.ai](https://altrouter.ai/)
- [Каталог моделей и цены](https://altrouter.ai/models)