Коротко
Gemini - самый дешёвый вход среди всех моделей каталога: $0.22 за миллион входных токенов у Gemini 3.1 Flash Lite. Для сравнения, у флагманов OpenAI и Anthropic вход стоит в 10-20 раз дороже.
Второе, что определяет цену: контекст 1M токенов у всей линейки, а не только у старших моделей. Залить в модель книгу целиком стоит ровно цену входа - от 22 центов за миллион токенов.
Из этого следует практическое: если задача звучит как «прочитать много и ответить по делу» - разбор документов, поиск по базе знаний, суммаризация переписки, - считать бюджет надо начиная с этой линейки. Ниже все цены и расчёты.
Цены линейки
| Модель | Вход, $/1M | Выход, $/1M | Контекст |
|---|---|---|---|
| gemini-3.1-flash-lite | 0.22 | 1.35 | 1M |
| gemini-2.5-flash | 0.27 | 2.25 | 1M |
| gemini-3-flash | 0.45 | 2.70 | 1M |
| gemini-3-pro | 0.75 | 5.25 | 1M |
| gemini-2.5-pro | 1.08 | 8.50 | 1M |
| gemini-3.5-flash | 1.35 | 8.10 | 1M |
| gemini-3.1-pro | 1.46 | 10.20 | 1M |
Это наши цены, они на 10-15% ниже официальных. Источник правды - каталог /models/: цены пересматриваются, статья стареет.
«Flash» не всегда дешевле «Pro»
Здесь линейка расставляет ловушку, на которую попадаются по привычке.
Логика «Flash - это дешёвая версия, Pro - дорогая» работает внутри одного поколения, но не между поколениями. Посмотрите на две строчки в таблице:
gemini-3.5-flash- $1.35 / $8.10gemini-3-pro- $0.75 / $5.25
Flash нового поколения стоит почти вдвое дороже, чем Pro предыдущего. Если вы выбираете модель по слову в названии, а не по цифре в таблице, счёт будет выше без всякой пользы.
То же самое с gemini-2.5-pro ($1.08) и gemini-3-pro ($0.75): более новая Pro-модель дешевле старой. Правило простое - сравнивать цены, а не суффиксы.
Сколько стоит миллион токенов контекста
Контекст 1M - главная особенность линейки, и её удобно считать напрямую: заполнить весь контекст один раз стоит ровно цену входа за 1M.
gemini-3.1-flash-lite- $0.22 за миллион токеновgemini-3-flash- $0.45gemini-3-pro- $0.75gemini-3.1-pro- $1.46
Миллион токенов - это примерно 1 200-1 500 страниц русского текста. То есть прогнать через модель книгу на 600 страниц и получить ответ стоит около 11 центов на Flash Lite.
Важная оговорка: платите вы за него в каждом запросе заново. Если гоняете один и тот же документ на 300 000 токенов десять раз с разными вопросами - это десять раз по цене входа, а не один. Скидки за повторно отправленный контекст у нас нет, вход считается по полной в каждом вызове.
Отсюда рабочий приём: если вопросов к документу много, задайте их одним запросом списком, а не десятью подряд.
Расчёты на реальных объёмах
Чат-бот: 1 500 токенов входа, 400 выхода
| Модель | Цена запроса | Запросов на $10 |
|---|---|---|
| gemini-3.1-flash-lite | $0.00088 | ~11 400 |
| gemini-2.5-flash | $0.00131 | ~7 700 |
| gemini-3-flash | $0.00176 | ~5 700 |
| gemini-3-pro | $0.00323 | ~3 100 |
| gemini-3.5-flash | $0.00527 | ~1 900 |
| gemini-3.1-pro | $0.00627 | ~1 600 |
Бот на тысячу обращений в день на Flash Lite стоит $26 в месяц - около 2 100 ₽ при курсе 80 ₽/$. На gemini-3.1-pro та же нагрузка обойдётся в $188.
Разбор документов: 300 000 токенов на документ
Договор, техдокументация, расшифровка длинного созвона. Вход 300 000 токенов, ответ 1 000.
| Модель | Один документ | 100 документов |
|---|---|---|
| gemini-3.1-flash-lite | $0.067 | $6.70 |
| gemini-3-flash | $0.138 | $13.80 |
| gemini-3-pro | $0.230 | $23.00 |
| gemini-3.1-pro | $0.448 | $44.80 |
Обратите внимание на пропорцию: выход тут почти не влияет на счёт - 99% денег уходит за чтение. Поэтому на длинных документах побеждают модели с дешёвым входом, а не самые сильные. Сравнение с другими провайдерами на той же задаче - в общей таблице цен.
Какую строчку брать под задачу
gemini-3.1-flash-lite- массовая обработка, классификация, извлечение полей, первичный разбор документов. Начинайте отсюда: запрос к ней обходится в 7 раз дешевле, чем к Gemini 3.1 Pro, а на рутине разницы в результате обычно нет.gemini-3-flash- когда Lite начинает мазать на формулировках, но платить за Pro не за что.gemini-3-pro- лучшее соотношение в линейке: дешевле, чем2.5-proи3.5-flash, при этом старшая модель текущего поколения.gemini-3.1-pro- задачи, где важна точность рассуждения, а не цена запроса.
Порядок работы, который экономит больше любых приёмов: взять 50 реальных задач, прогнать на Lite, посмотреть на брак. Не устраивает - поднимать модель на одну строчку и повторять. Почти всегда останавливаешься раньше, чем доходишь до Pro.
Бесплатная квота Google
У Google есть бесплатный доступ к API - и это честный ответ на вопрос «зачем тогда платить». Коротко: бесплатная квота ограничена по частоте запросов, у неё другие условия использования данных, и она плохо переживает переход от эксперимента к продукту, когда трафик становится неровным.
Разобрали подробно, где именно она кончается и как понять, что вы упёрлись, в статье бесплатный API Gemini.
Что не входит в цену
Рассуждения оплачиваются как выход. У моделей с размышлением часть выходных токенов уходит во внутренний блок, которого нет в ответе, но который есть в счёте.
Русский текст дороже английского. Кириллица режется на более мелкие токены, поэтому та же страница на русском стоит примерно вдвое дороже. При расчёте бюджета для русскоязычного продукта закладывайте запас.
Картинки тарифицируются отдельно. Модели Google для генерации изображений - от $0.035 за картинку у Nano Banana до $0.216 за 4K у Nano Banana Pro. Это другой счётчик, не токены.
Неудачные запросы тоже стоят денег. Токены израсходованы, даже если ответ не подошёл. Промпт отлаживают на Flash Lite, а не на Pro.
Как посчитать свой счёт
Отправьте настоящий промпт и посмотрите фактический расход:
from openai import OpenAI
client = OpenAI(
base_url="https://api.altrouter.ai/v1",
api_key="ar-...",
)
r = client.chat.completions.create(
model="gemini-3.1-flash-lite",
messages=[{"role": "user", "content": "Ваш реальный промпт целиком"}],
max_tokens=400,
)
print(r.usage)
API OpenAI-совместимый, поэтому Gemini вызывается той же библиотекой openai - меняются только base_url, api_key и model. Что ещё умеет линейка помимо цены - в статье Gemini API: ключ, цены и контекст 1M.
Проверить всё до оплаты можно на стартовом балансе: за подтверждённый Telegram начисляется $1, а это больше 1 100 запросов к Flash Lite.
FAQ
Сколько стоит Gemini API за 1 000 запросов?
При запросе в 1 500 входных и 400 выходных токенов тысяча обращений стоит $0.88 на Gemini 3.1 Flash Lite, $1.76 на Gemini 3 Flash и $6.27 на Gemini 3.1 Pro. Это самые низкие цены среди текстовых моделей каталога.
Сколько стоит использовать контекст в 1 миллион токенов?
Ровно цену входа за 1M: от $0.22 на Flash Lite до $1.46 на Gemini 3.1 Pro. Миллион токенов - это примерно 1 200-1 500 страниц текста. Платить придётся в каждом запросе заново, поэтому несколько вопросов к одному документу дешевле задать одним обращением.
Какая модель Gemini самая дешёвая?
Gemini 3.1 Flash Lite: $0.22 за миллион входных токенов и $1.35 за миллион выходных, контекст 1M. Это самый дешёвый вход во всём каталоге - примерно в 27 раз дешевле самой дорогой текстовой модели.
Gemini дешевле ChatGPT API?
Да, заметно. Вход на Gemini 3.1 Flash Lite стоит $0.22 против $0.85 у GPT-5.6 Mini и $2.13 у GPT-5.6. На задачах с длинным входом - разбор документов, поиск по базе знаний - разница в счёте получается кратной.
Есть ли у Gemini бесплатный API?
Бесплатная квота у Google есть, но она ограничена по частоте запросов и подходит для экспериментов, а не для продукта с реальным трафиком. Условия использования данных на бесплатном тарифе тоже отличаются от платного - это стоит проверить до того, как отправлять туда чужие данные.
Почему Flash оказался дороже Pro?
Потому что суффикс обозначает место модели внутри своего поколения, а не абсолютную цену. Gemini 3.5 Flash стоит $1.35 за вход, а Gemini 3 Pro - $0.75: более новая быстрая модель дороже более старой мощной. Сравнивать нужно цифры в таблице, а не названия.