Gemini 3.8 Flash

GoogleТекстРассужденияИнструментыЗрение

Gemini 3.8 Flash: свежайшая быстрая Gemini, цена та же, что у 3.6 и 3.7, контекст 1M.

Наша цена
$0.64 / $3.19
вход / выход за 1M
Официальная
$0.75 / $3.75
15% к официальной

Первый запрос

from openai import OpenAI

client = OpenAI(
    base_url="https://api.altrouter.ai/v1",
    api_key="ar-...",
)

resp = client.chat.completions.create(
    model="gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.choices[0].message.content)
API

OpenAI-совместимый эндпоинт chat completions, со стримингом (SSE).

POST/v1/chat/completions
Параметры тела
modelstringrequired"gemini-3.8-flash"
Идентификатор модели.
messagesarrayrequired
История диалога: [{ role, content }].
streambooleandefault false
Стриминг ответа по SSE.
temperaturenumber0–2default 1
Случайность генерации: ниже - детерминированнее, выше - креативнее.
top_pnumber0–1default 1
Nucleus sampling - доля вероятностной массы.
max_tokensnumber1–32000
Максимум токенов в ответе.
reasoning_effortenumlow · medium · highdefault medium
Бюджет «размышлений» для reasoning-моделей.
seednumber0–2147483647
Seed для воспроизводимости.
frequency_penaltynumber-2–2
Штраф за повтор токенов по частоте.
presence_penaltynumber-2–2
Штраф за токены, которые уже встречались.
web_searchbooleandefault false
Поиск в интернете на стороне модели - ответы по свежим данным.

Структурированные поля (tools, response_format, stop и другие) - в полном справочнике параметров.

Ответ
idstring
Идентификатор ответа.
choicesarray
Варианты ответа. Каждый: index, message { role, content, reasoning_content, tool_calls }, finish_reason.
usageobject
Токены: prompt_tokens, completion_tokens, total_tokens.
Пример
cURLPythonJSON
curl https://api.altrouter.ai/v1/chat/completions \
  -H "Authorization: Bearer ar-..." \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.8-flash",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "reasoning_effort": "medium"
}'
Ошибки
400Некорректный запрос.
401Нет или неверный API-ключ.
402Недостаточно кредитов или исчерпан потолок трат ключа.
404Модель не найдена.
429Превышен лимит запросов.

Частые вопросы

Сколько стоит Gemini 3.8 Flash через API?
$0.64 за миллион входных токенов и $3.19 за миллион выходных. Это на 15% ниже официальной цены вендора — $0.75 и $3.75. Счёт ведётся в рублях, баланс пополняется картой РФ, через СБП или криптой — зарубежная карта не нужна.
Работает ли Gemini 3.8 Flash из России?
Да, и без VPN. Запрос уходит на api.altrouter.ai, а до Google ходим мы, а не вы. Отдельный аккаунт у вендора при этом не нужен.
Как подключить Gemini 3.8 Flash?
Интерфейс OpenAI-совместимый: в вашем коде меняются base_url на https://api.altrouter.ai/v1 и ключ, а модель указывается идентификатором gemini-3.8-flash. Остальной код трогать не нужно.
Справочник API
Какой контекст у Gemini 3.8 Flash?
1 000 000 токенов на запрос — это весь ваш ввод вместе с историей диалога и системным промптом. Что не влезло, модель не увидит, и платите вы за то, что влезло.
Можно ли попробовать Gemini 3.8 Flash бесплатно?
Отдельного бесплатного тарифа нет. За подтверждённый Telegram на баланс начисляется $1 — один раз на человека, этого хватает, чтобы прогнать модель на своей задаче до того, как платить.

Ещё от Google