← Блог

Сколько стоит Claude API: цены Haiku, Sonnet и Opus

· 8 минут чтения

Коротко

Claude - самая дорогая линейка в каталоге, и разброс внутри неё семикратный. Один и тот же запрос стоит $0.0028 на Haiku 4.5 и $0.021 на Fable 5.

Миллион входных токенов обойдётся от $0.77 у Haiku до $6 у Fable 5, выходных - от $4 до $30. Контекст у всех моделей семейства одинаковый: 200 000 токенов.

Главная особенность в расчётах - рассуждения. У Claude режим размышления включается отдельно, и токены размышления оплачиваются как выходные, хотя в ответе вы их не видите. Именно из-за них фактический счёт чаще всего оказывается втрое выше расчётного. Разбор ниже.

Цены всех моделей Claude

МодельВход, $/1MВыход, $/1MКонтекст
claude-haiku-4-50.774.00200K
claude-sonnet-51.698.50200K
claude-sonnet-4-52.6813.50200K
claude-sonnet-4-62.6813.50200K
claude-opus-4-53.7418.75200K
claude-opus-4-63.9920.00200K
claude-opus-4-73.9920.00200K
claude-opus-4-84.5022.50200K
claude-fable-56.0030.00200K

Это наши цены - ниже официальных на 10-25% в зависимости от модели. Актуальные цифры в каталоге /models/.

За что доплата в Opus

Линейка устроена как три уровня, и различие в цене между ними - не маркетинг.

Haiku ($0.77 / $4.00) - рабочая лошадка для рутины: классификация, извлечение полей, короткие ответы по инструкции, разбор однотипных документов. На массовых задачах её стоит пробовать первой.

Sonnet ($1.69 / $8.50 у текущего поколения) - разумный дефолт. Достаточно силён для работы с кодом и длинных рассуждений, вдвое дешевле Opus.

Opus ($3.74-4.50 / $18.75-22.50) - задачи, где ошибка дороже токенов: сложный рефакторинг, юридические тексты, анализ, который потом никто не будет перепроверять.

Fable 5 ($6 / $30) - самая дорогая строчка каталога вообще. Доставать осознанно и точно не для потока.

Практическое правило: разница между Haiku и Opus в счёте - примерно шестикратная.

Ступенчатая диаграмма, показывающая рост цены от модели Haiku к моделям Opus и Fable.
Чем мощнее модель, тем дороже обходится каждый миллион токенов.
Если вы не можете назвать конкретную причину, почему на вашей задаче Haiku не справится, - начинайте с Haiku и поднимайте модель по факту брака.

Новое поколение обычно дешевле старого

Неочевидная вещь, на которой теряют деньги: цена внутри одного уровня падает с новыми выпусками.

  • claude-sonnet-4-5 и claude-sonnet-4-6 - $2.68 / $13.50
  • claude-sonnet-5 - $1.69 / $8.50

Текущий Sonnet дешевле предыдущих на 37% при том, что он новее и сильнее.

Сравнение стоимости старой и новой версии модели Sonnet, где новая стоит дешевле.
Простое обновление версии модели в коде может снизить расходы на треть без потери качества.
Если у вас в коде зашит claude-sonnet-4-5 с прошлого года - это лишняя треть счёта каждый месяц просто по инерции.

То же с Opus: 4.5 стоит $3.74, а 4.8 - $4.50. Тут наоборот, старшая версия дороже, так что автоматом обновлять строку модели тоже не стоит - сверяйтесь с таблицей.

Рассуждения - главная незаметная статья расхода

У Claude размышление включается отдельным параметром, и это единственное место, где счёт может вырасти в разы без изменения промпта.

Механика простая: токены размышления тарифицируются как выходные. Вы их не видите в ответе, но платите за каждый.

Посчитаем. Запрос на 1 500 входных токенов, видимый ответ - 400 токенов:

  • без размышления: 1 500 входа + 400 выхода на Sonnet 5 = $0.0059
  • с размышлением на 2 000 токенов: 1 500 входа + 2 400 выхода = $0.0229

Тот же вопрос, тот же ответ на экране, счёт почти в четыре раза выше. На тысяче запросов в день это разница между $178 и $687 в месяц.

Вывод не «выключите размышление», а «включайте осознанно». На классификации и извлечении данных оно не нужно совсем. На разборе сложного кода - окупается. Управлять этим можно параметром в запросе, а увидеть фактический расход - в поле usage ответа и в логах кабинета.

Расчёты на реальных объёмах

Один запрос: 1 500 токенов входа, 400 выхода

МодельЦена запросаЗапросов на $10
claude-haiku-4-5$0.0028~3 600
claude-sonnet-5$0.0059~1 700
claude-sonnet-4-5$0.0094~1 100
claude-opus-4-5$0.0131~760
claude-opus-4-8$0.0158~630
claude-fable-5$0.0210~480

Бот поддержки: 1 000 обращений в день

30 000 запросов в месяц того же размера:

  • claude-haiku-4-5 - $83 в месяц
  • claude-sonnet-5 - $178
  • claude-opus-4-8 - $473
  • claude-fable-5 - $630

Между первой и последней строчкой - $547 в месяц на одной и той же задаче.

Работа с кодом: 200 запросов в день с файлами

Здесь вход большой - код, который вы подкладываете в контекст. Возьмём 15 000 токенов входа и 800 выхода.

МодельЦена запросаВ месяц
claude-haiku-4-5$0.0148~$89
claude-sonnet-5$0.0322~$193
claude-opus-4-8$0.0855~$513

И это без размышления - с ним смело умножайте на три. Именно поэтому ассистенты для кода так быстро съедают бюджет: там и длинный вход, и включённое размышление одновременно.

Заполнить весь контекст 200K

Один запрос, в который залит максимум контекста:

  • Haiku 4.5 - $0.15
  • Sonnet 5 - $0.34
  • Opus 4.8 - $0.90
  • Fable 5 - $1.20

И платится это в каждом запросе заново: скидки за повторно отправленный контекст у нас нет. Десять вопросов к одному большому документу - десять полных оплат входа. Дешевле задать их одним запросом списком.

Чего у нас с Claude нет

Честно, чтобы вы не потратили вечер:

Входящего Anthropic-совместимого эндпоинта /v1/messages у нас нет. Модели Claude вызываются через OpenAI-совместимый /v1/chat/completions. Практическое следствие: инструменты, которые умеют говорить только на диалекте Anthropic - в первую очередь Claude Code, - к нам сейчас не подключаются. Если вам нужен именно он, наш вариант не подойдёт.

Скидки за повторный контекст нет, вход считается по полной цене в каждом запросе.

Эмбеддингов и batch-обработки нет. Если сценарий на них завязан - это к вендору напрямую.

Что работает: обычные чат-запросы, стриминг, структурированный вывод, инструменты, параметры включая max_tokens и переключатель размышления. Разбор ошибок 401, 429 и 529 - в статье ошибки Claude API, а что вообще доступно из России - в статье Claude в России.

Как измерить свой расход

from openai import OpenAI

client = OpenAI(
    base_url="https://api.altrouter.ai/v1",
    api_key="ar-...",
)

r = client.chat.completions.create(
    model="claude-haiku-4-5",
    messages=[{"role": "user", "content": "Ваш реальный промпт целиком"}],
    max_tokens=400,
)
print(r.usage)

usage покажет фактические входные и выходные токены - вместе с размышлением, если оно включено. Умножьте на цену из таблицы и на дневной объём: это ваш месячный бюджет без прикидок.

Если параметр max_tokens не передан, мы подставляем 4096 - это страховка от запроса, который случайно съест баланс, но не замена настройке. Остальные приёмы экономии - в статье как снизить расходы на токены, а сравнение с моделями других провайдеров - в общей таблице цен.

Стартовый баланс - $1 за подтверждённый Telegram, около 360 запросов к Haiku 4.5, чтобы всё это проверить до оплаты.

FAQ

Сколько стоит Claude API за 1 000 запросов?

При запросе в 1 500 входных и 400 выходных токенов тысяча обращений стоит $2.80 на Haiku 4.5, $5.90 на Sonnet 5 и $15.80 на Opus 4.8. Если включено размышление, умножайте примерно втрое: его токены тарифицируются как выходные.

Какая модель Claude самая дешёвая?

Haiku 4.5: $0.77 за миллион входных токенов и $4 за миллион выходных при контексте 200K. Для классификации, извлечения данных и однотипной обработки документов её обычно достаточно, а разница с Opus в счёте - шестикратная.

Почему счёт за Claude больше, чем я рассчитывал?

Чаще всего из-за размышления: его токены оплачиваются как выходные, но в ответе не показываются, поэтому расчёт «по видимому ответу» занижает счёт в два-четыре раза. Вторая причина - история диалога, которая уезжает на сервер заново в каждом запросе.

Чем Sonnet отличается от Opus по деньгам?

Sonnet 5 стоит $1.69 за миллион входных токенов, Opus 4.8 - $4.50, то есть примерно в 2,7 раза дороже; по выходным токенам разница такая же. Opus имеет смысл на задачах, где цена ошибки выше цены токенов, для потоковой работы обычно берут Sonnet или Haiku.

Работает ли Claude Code через ваш API?

Нет. Claude Code говорит на Anthropic-совместимом протоколе /v1/messages, а у нас входящий эндпоинт OpenAI-совместимый. Модели Claude доступны через /v1/chat/completions - этого достаточно для своего кода, ботов и большинства библиотек, но не для самого Claude Code.

Как оплатить Claude API из России?

Прямая оплата Anthropic упирается в зарубежную карту и поддерживаемые страны. Через российский шлюз баланс пополняется рублями - картой, СБП или криптой, - а в коде указываются base_url и ключ; сами модели те же самые.