altrouter.ai
Модели/Google/Gemini 3 Flash
GM

Google: Gemini 3 Flash

Текстgemini-3-flash

Поколение 3: быстрая мультимодальная Gemini с улучшенными рассуждениями.

Документация API
Playgroundgemini-3-flash
Температура
Top-p
Макс. токенов
Рассуждение
Seed
Штраф частоты
Штраф присутствия
Веб-поиск
Пропускная способность158 ток/с
24 чсейчас
Латентность0.85 с
24 чсейчас
Характеристики
Авторgoogle
МодальностьТекст
Контекст1M токенов
Цена входа$0.45/M токенов$0.50/M токенов
Цена выхода$2.70/M токенов$3.00/M токенов
Экономия10%
Возможностиreasoning, инструменты, картинки на входе
Быстрый старт
from openai import OpenAI

client = OpenAI(
    base_url="https://api.altrouter.ai/v1",
    api_key="ar-...",
)

resp = client.chat.completions.create(
    model="gemini-3-flash",
    messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.choices[0].message.content)

Тот же OpenAI-совместимый эндпоинт, поменяйте только base_url и ключ.

API

OpenAI-совместимый эндпоинт chat completions, со стримингом (SSE).

POST/v1/chat/completions
Параметры тела
modelstringrequired"gemini-3-flash"
Идентификатор модели.
messagesarrayrequired
История диалога: [{ role, content }].
streambooleandefault false
Стриминг ответа по SSE.
temperaturenumber0–2default 1
Случайность генерации: ниже — детерминированнее, выше — креативнее.
top_pnumber0–1default 1
Nucleus sampling — доля вероятностной массы.
max_tokensnumber1–32000
Максимум токенов в ответе.
reasoning_effortenumlow · medium · highdefault medium
Бюджет «размышлений» для reasoning-моделей.
seednumber0–2147483647
Seed для воспроизводимости.
frequency_penaltynumber-2–2
Штраф за повтор токенов по частоте.
presence_penaltynumber-2–2
Штраф за токены, которые уже встречались.
web_searchbooleandefault false
Поиск в интернете на стороне модели — ответы по свежим данным.

Структурированные поля (tools, response_format, stop и другие) — в полном справочнике параметров.

Ответ
idstring
Идентификатор ответа.
choicesarray
Варианты ответа. Каждый: index, message { role, content, reasoning_content, tool_calls }, finish_reason.
usageobject
Токены: prompt_tokens, completion_tokens, total_tokens.
Пример
cURLPythonJSON
curl https://api.altrouter.ai/v1/chat/completions \
  -H "Authorization: Bearer ar-..." \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3-flash",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "reasoning_effort": "medium"
}'
Ошибки
400Некорректный запрос.
401Нет или неверный API-ключ.
402Недостаточно кредитов или исчерпан потолок трат ключа.
404Модель не найдена.
429Превышен лимит запросов.
Ещё от Google
Gemini 3.1 Flash Lite
gemini-3.1-flash-lite
Gemini 2.5 Flash
gemini-2.5-flash
Gemini 3.5 Flash
gemini-3.5-flash
Gemini 2.5 Pro
gemini-2.5-pro
Gemini 3.1 Pro
gemini-3.1-pro
Gemini 3 Pro
gemini-3-pro
Nano Banana Fast
nano-banana-fast
Nano Banana
nano-banana
Nano Banana 2
nano-banana-2
Nano Banana Pro
nano-banana-pro
Veo 3.1
veo-3.1
Veo 3.1 Fast
veo-3.1-fast