Kimi K3

Moonshot AIТекстРассужденияИнструментыЗрение

Kimi K3 от Moonshot: флагман для длинных задач по коду, всегда рассуждает, контекст 1M.

Наша цена
$3.45 / $17.25
вход / выход за 1M

Первый запрос

from openai import OpenAI

client = OpenAI(
    base_url="https://api.altrouter.ai/v1",
    api_key="ar-...",
)

resp = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.choices[0].message.content)

Интерфейс OpenAI-совместимый: в готовом коде меняются только base_url, ключ и идентификатор модели — остальное трогать не нужно.

Kimi K3 и соседи по цене

Kimi K3 и ближайшие по цене модели: цены и параметры из каталога AltRouter AI
МодельВход / 1MВыход / 1MКонтекст
Gemini 3.1 ProGoogle$1.46$10.201MОткрыть
GPT-5.6OpenAI$2.13$12.75400KОткрыть
Kimi K3эта модельMoonshot AI$3.45$17.251.0M
Claude Opus 4.8Anthropic$4.50$22.50200KОткрыть
GPT-5.6 ProOpenAI$4.25$25.50400KОткрыть

Цены и параметры — из того же каталога, что и прайс выше; это не бенчмарк, а сопоставимые условия оплаты.

Лимиты

Контекст — 1.0M токенов на запрос. В него входит всё, что вы отправили: системный промпт, история диалога и текущий вопрос вместе. Что не поместилось, модель не увидит — обрезать историю приходится на своей стороне, и платите вы ровно за то, что поместилось.

Длина ответа задаётся параметром max_tokens, потолок — 32 000 токенов за вызов. Ответ, упёршийся в этот потолок, приходит с finish_reason: "length": он оборван, но оплачен, поэтому на длинных генерациях значение стоит выставлять осознанно.

Поддерживается: режим рассуждений, вызов инструментов (tools), картинки на входе.

Подписки нет: деньги списываются за каждый успешный запрос по цене выше, а неудавшийся не оплачивается. Наценки сверх официальной цены вендора нет. Отдельного аккаунта у Moonshot AI для этого не нужно, и VPN тоже: запрос уходит на api.altrouter.ai, а до вендора ходим мы.

Ограничение частоты общее для всех моделей и считается на ключ: 600 запросов в минуту по умолчанию, при превышении — 429 с заголовком retry-after: 60. Для отдельного ключа лимит и потолок трат за день, неделю, месяц или всё время настраиваются в кабинете.

Полные лимиты и кредиты

Когда выбирать Kimi K3, а когда соседнюю

Дешевле рядом — GPT-5.6: $2.13 за 1M входных токенов против $3.45 у Kimi K3. На одном и том же объёме счёт выходит в 1,6 раза меньше. Контекст меньше: 400K против 1.0M — длинные документы придётся резать. Это разумный выбор там, где задача типовая и её много: разметка, классификация, короткие ответы по шаблону — то есть там, где качество упирается не в модель, а в промпт.

Дороже рядом — Claude Opus 4.8: $4.50 за 1M входных токенов, то есть в 1,3 раза дороже. По параметрам каталога — тот же набор возможностей и тот же порядок контекста, поэтому переплата оправдана только если Kimi K3 на вашей задаче не справляется.

Проверять догадки здесь дешевле, чем рассуждать: сравнение выше — это цены и параметры, а не бенчмарк, и оно не скажет, какая модель лучше именно на вашем промпте. Переключение стоит одной строки — меняется идентификатор модели в запросе, base_url и ключ остаются те же, — так что прогнать обе на своих данных занимает минуты.

API

OpenAI-совместимый эндпоинт chat completions, со стримингом (SSE).

POST/v1/chat/completions
Параметры тела
modelstringrequired"kimi-k3"
Идентификатор модели.
messagesarrayrequired
История диалога: [{ role, content }].
streambooleandefault false
Стриминг ответа по SSE.
max_tokensnumber1–32000
Максимум токенов в ответе.
reasoning_effortenumlow · medium · highdefault medium
Бюджет «размышлений» для reasoning-моделей.
seednumber0–2147483647
Seed для воспроизводимости.
frequency_penaltynumber-2–2
Штраф за повтор токенов по частоте.
presence_penaltynumber-2–2
Штраф за токены, которые уже встречались.

Структурированные поля (tools, response_format, stop и другие) - в полном справочнике параметров.

Ответ
idstring
Идентификатор ответа.
choicesarray
Варианты ответа. Каждый: index, message { role, content, reasoning_content, tool_calls }, finish_reason.
usageobject
Токены: prompt_tokens, completion_tokens, total_tokens.
Пример
cURLPythonJavaScriptJSON
curl https://api.altrouter.ai/v1/chat/completions \
  -H "Authorization: Bearer ar-..." \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ],
  "reasoning_effort": "medium"
}'
Ошибки
400Некорректный запрос.
401Нет или неверный API-ключ.
402Недостаточно кредитов или исчерпан потолок трат ключа.
404Модель не найдена.
429Превышен лимит запросов.

Частые вопросы

Сколько стоит Kimi K3 через API?
$3.45 за миллион входных токенов и $17.25 за миллион выходных. Счёт ведётся в рублях, баланс пополняется картой РФ, через СБП или криптой — зарубежная карта не нужна.
Работает ли Kimi K3 из России?
Да, и без VPN. Запрос уходит на api.altrouter.ai, а до Moonshot AI ходим мы, а не вы. Отдельный аккаунт у вендора при этом не нужен.
Как подключить Kimi K3?
Интерфейс OpenAI-совместимый: в вашем коде меняются base_url на https://api.altrouter.ai/v1 и ключ, а модель указывается идентификатором kimi-k3. Остальной код трогать не нужно.
Справочник API
Какой контекст у Kimi K3?
1 048 576 токенов на запрос — это весь ваш ввод вместе с историей диалога и системным промптом. Что не влезло, модель не увидит, и платите вы за то, что влезло.
Можно ли попробовать Kimi K3 бесплатно?
Отдельного бесплатного тарифа нет. За подтверждённый Telegram на баланс начисляется $1 — один раз на человека, этого хватает, чтобы прогнать модель на своей задаче до того, как платить.