Вы вставляете адрес API в настройки, жмёте «Сохранить», и программа отвечает ошибкой проверки. Или форма сохраняется, бот отвечает, но на длинном диалоге начинает забывать начало разговора. Чаще всего дело не в ключе и не в сервисе, а в одном поле формы, которое заполнено не так или оставлено по умолчанию.
Общее правило, по которому инструмент вообще принимает чужой адрес API, мы разбирали в статье про свой ключ в редакторах кода. Здесь другие герои: десктопный чат-клиент Cherry Studio и no-code платформа Dify, где ботов и агентов собирают из блоков. Разберём их формы поле за полем.
Коротко
Оба инструмента подключаются к OpenAI-совместимому ключу без доработок, но у каждого есть настройка по умолчанию, которая тихо портит результат.
- Cherry Studio сама подтягивает список моделей, но тянет всё подряд, включая модели для картинок и видео. В чат добавлять только текстовые.
- Dify добавляет модели по одной и по умолчанию считает контекст любой модели равным 4096 токенам. Это поле надо исправить руками.
- Для агента в Dify вызов инструментов по умолчанию выключен, и не каждая модель вызывает инструменты одинаково.
- На ключе altrouter не заработают база знаний Cherry Studio, режим High Quality в базе знаний Dify и агент Cherry Studio. Ниже объясняем почему.
- Месяц личного чата на Gemini 3.1 Flash Lite по нашему расчёту стоит $1,62.
Cherry Studio: адрес, ключ и список моделей
Cherry Studio — открытый десктопный клиент для Windows, macOS и Linux. Актуальная версия на 15.09.2026 — v2.0.14 от 9 сентября.
Путь к форме: шестерёнка Настройки → Сервисы моделей → кнопка + Добавить под списком провайдеров. В окне задаёте имя провайдера (любое, например altrouter), тип эндпоинта OpenAI и ключ.
API-адрес. Документация Cherry Studio просит вписывать базовый адрес: клиент сам допишет /v1/chat/completions. По исходному коду версии v2.0.14 версию второй раз он не добавляет, если адрес уже оканчивается на /v1. Поэтому подходят оба варианта: https://api.altrouter.ai и https://api.altrouter.ai/v1. Не подходит полный путь до чата: адрес склеится дважды. Исключение одно: если адрес заканчивается символом #, клиент не дописывает ничего и шлёт запрос ровно туда, что вы указали.

API-ключ. Сюда вставляется ключ вида ar-... из кабинета. Можно вписать несколько ключей через английскую запятую, клиент будет чередовать их по кругу.
Список моделей. Кнопка Получить список моделей делает запрос GET /v1/models. На 15.09.2026 наш API отдаёт 66 моделей: 29 текстовых, 20 для картинок и 17 для видео. Cherry Studio покажет все 66, а в чат попадут только те, что вы добавите плюсом. Добавляйте текстовые: на модель картинок в чате API ответит ошибкой 404 с пояснением, что это не чат-модель.
Включение. После добавления провайдера включите его переключателем в правом верхнем углу страницы. Без этого модели не появятся в выборе в окне чата. Кнопка Проверить отправит тестовый запрос выбранной модели: если он прошёл, настройка закончена.
Dify: какие поля в форме модели править руками
Dify — платформа для сборки чат-ботов, workflow и агентов в визуальном редакторе, есть облачная версия и самостоятельная установка через Docker. Актуальный релиз на 15.09.2026 — 1.17.1.
Модели в Dify подключаются плагинами. Для любого OpenAI-совместимого API нужен официальный плагин OpenAI-API-compatible из Marketplace, на момент проверки версия 0.0.66. Ставится он в разделе Integrations → Model Provider. Добавлять модели могут только владелец и администраторы пространства.
Списка моделей этот плагин не запрашивает: каждую модель добавляют отдельной формой. Вот поля, от которых зависит результат.
- Model Type — LLM.
- Model Name — точный идентификатор модели из каталога, например
gemini-3.1-flash-lite. - API Key — ваш ключ.
- API Base URL —
https://api.altrouter.ai/v1. Плагин сам допишетchat/completions, и его README прямо просит не вставлять полный путь. - Completion mode — оставить Chat.
- Model context size — по умолчанию 4096. Впишите реальный контекст модели: у Gemini 3.1 Flash Lite и Gemini 3.5 Flash в нашем каталоге это 1 000 000 токенов, у Grok 4.3 — 256 000. Цифра лежит в поле
context_lengthответа/v1/models. - Upper bound for max tokens — верхняя граница длины ответа, тоже 4096 по умолчанию. Поднимайте, если ждёте длинных ответов.
- Function Call Type — по умолчанию «Not Support». Для агента с инструментами выберите Tool Call, иначе Dify не передаст модели описание инструментов.
- API Type — оставить Chat Completions. Вариант Responses API ведёт на ручку
/responses, которой у нас нет.
🔴 Про контекст подробнее. 4096 токенов в 244 раза меньше миллиона, который держит Gemini 3.1 Flash Lite. Dify не спрашивает размер окна у модели, а берёт его из этого поля и по нему решает, сколько истории и контекста поместится в запрос. При сохранении формы ошибка никак не проявится: всплывёт позже, на длинных диалогах и больших документах.

Проверка при сохранении. По исходному коду плагина Dify отправляет на API Base URL короткий запрос: сообщение ping и max_tokens равный 5. Сохранение пройдёт, только если ответ пришёл со статусом 200 и типом объекта chat.completion. Если модель называется на o1, o3 или gpt-5, плагин проверяет её через параметр max_completion_tokens.
Что показала проверка запросов обоих клиентов
Сразу про метод: интерфейсы Cherry Studio и Dify мы не запускали. Мы прочитали документацию и исходный код (Cherry Studio v2.0.14, плагин Dify 0.0.66), выписали, какие именно HTTP-запросы они отправляют, и 15.09.2026 повторили эти запросы к нашему API.
Сценариев было четыре: список моделей и потоковый чат Cherry Studio, проверка ключа при сохранении в Dify и вызов модели из приложения Dify с полем user.
Список моделей вернулся в том формате, который ждёт Cherry Studio. На Gemini 3.1 Flash Lite три остальных сценария мы прогнали по четыре раза: 12 запросов из 12 вернули статус 200 и текст ответа. Потоковый ответ заканчивался штатным сигналом [DONE], в последнем фрагменте приходила статистика токенов, по которой клиенты считают расход. Проверочный запрос Dify занимал от 2,4 до 9,8 секунды.
Отдельно проверили вызов инструментов в том виде, как его шлёт Dify при Tool Call: с полями tools и tool_choice. Gemini 3.5 Flash и Grok 4.3 вернули запрос на вызов функции с правильным аргументом. Gemini 3.1 Flash Lite на тот же запрос ответила обычным текстом и инструмент не вызвала. Для простого чата она подходит, для агента с инструментами — нет. Как устроен сам механизм, мы разбирали в статье про вызов инструментов.
Это проверка совместимости, а не нагрузочный тест: 12 вызовов на одной модели и точечные проверки инструментов на трёх.
Чего на этом ключе не будет
Здесь наш минус, и лучше знать его до настройки.
Эмбеддингов у altrouter нет. Эмбеддинги — это числовые векторы текста, по которым база знаний ищет похожие фрагменты. Ручка /v1/embeddings на 15.09.2026 отвечает 404. Отсюда два следствия:
- база знаний Cherry Studio на нашем ключе не заработает, для неё нужен второй провайдер с моделью эмбеддингов;
- в Dify база знаний работает только в режиме Economical. По документации Dify он ищет по 10 ключевым словам на фрагмент и не тратит токены, но находит хуже. Режим High Quality требует модель эмбеддингов.
Агент Cherry Studio не запустится. Документация Cherry Studio пишет, что режиму агента нужен нативный протокол Anthropic. У нас есть только OpenAI-совместимая ручка /v1/chat/completions, а /v1/messages отвечает 404. Обычные чаты в Cherry Studio это не затрагивает.
Сколько стоит месяц работы
Цены взяты из нашего каталога на 12.09.2026, официальные — со страниц Google и xAI на 15.09.2026. У Gemini 3.1 Flash Lite и Gemini 3.5 Flash наша цена на 10% ниже официальной цены вендора, у Grok 4.3 — на 15%. У xAI ставка удваивается для запросов от 200 000 токенов, в сценариях ниже запросы короткие.
Входных токенов в обоих инструментах в шесть-семь раз больше, чем выходных, и растут именно они. Модель ничего не помнит между запросами: вся история диалога, системный промпт и найденные куски базы знаний уходят заново с каждым сообщением. Почему это особенно больно для агентов, мы считали в статье про ИИ-агентов.
Сценарий А, личный ассистент в Cherry Studio. 40 сообщений в день, 1200 в месяц. В среднем 3000 токенов входа с накопленной историей и 500 токенов ответа. За месяц — 3,6 млн токенов входа и 0,6 млн выхода.

Сценарий Б, бот поддержки в Dify. 3000 сообщений в месяц, 2000 токенов входа (системный промпт, фрагменты базы знаний, история сессии) и 300 токенов ответа. За месяц — 6 млн входа и 0,9 млн выхода.
| Модель | Сценарий А, Cherry Studio | Сценарий Б, Dify |
|---|---|---|
| Gemini 3.1 Flash Lite | $1,62 (по официальной цене $1,80) | $2,56 (по официальной цене $2,85) |
| Grok 4.3 | $5,10 (по официальной цене $6,00) | $8,29 (по официальной цене $9,75) |
| Gemini 3.5 Flash | $9,72 (по официальной цене $10,80) | $15,39 (по официальной цене $17,10) |
Что из этого следует. Минимального пополнения в $10 хватает на месяц личного чата даже на Gemini 3.5 Flash, а бота поддержки на Flash Lite — почти на четыре месяца. Сценарии — наши допущения о среднем объёме, а не данные реальных пользователей: подставьте свои цифры сообщений и токенов, арифметика та же.
С чего начать
- Выпустите ключ в кабинете altrouter. Пополнение — картой РФ, через СБП или криптой, от $10.
- Откройте
/v1/modelsили каталог на сайте и выпишите идентификаторы иcontext_lengthнужных текстовых моделей. - В Cherry Studio добавьте провайдера типа OpenAI с адресом
https://api.altrouter.ai, получите список, добавьте плюсом текстовые модели и включите провайдера. - В Dify поставьте плагин OpenAI-API-compatible и добавьте модель с API Base URL
https://api.altrouter.ai/v1, реальным Model context size и, для агента, Tool Call. - Перед сборкой агента проверьте, что выбранная модель действительно вызывает инструменты: дайте ей простую задачу с одним инструментом.
Каталог текстовых моделей с ценами и размером контекста — на странице altrouter.ai/models, ключ выпускается на altrouter.ai.
FAQ
Какой адрес API указывать в Cherry Studio?
Подойдут оба варианта: https://api.altrouter.ai и https://api.altrouter.ai/v1. Cherry Studio сама допишет путь до чата, а если версия в адресе уже есть, второй раз её не добавит. Не вставляйте полный путь с chat/completions.
Почему Dify не сохраняет модель и пишет ошибку проверки?
При сохранении Dify отправляет пробный запрос и ждёт ответ со статусом 200. Проверьте три вещи: API Base URL равен https://api.altrouter.ai/v1 без хвоста, имя модели совпадает с идентификатором из каталога символ в символ, ключ скопирован целиком.
Почему в Cherry Studio модели не видны в окне чата?
Скорее всего, провайдер не включён или модели не добавлены из списка. После получения списка нажмите плюс у нужных моделей и включите провайдера переключателем в правом верхнем углу страницы настроек.
Какой размер контекста ставить в Dify?
Реальный контекст модели, а не 4096 по умолчанию. Его можно взять из поля context_length в ответе /v1/models: например, 1 000 000 у Gemini 3.1 Flash Lite и 256 000 у Grok 4.3.
Почему агент в Dify не вызывает инструменты?
Сначала проверьте, что в настройках модели Function Call Type стоит в положении Tool Call. Если стоит, дело в модели: в нашей проверке Gemini 3.5 Flash и Grok 4.3 инструменты вызывали, а Gemini 3.1 Flash Lite ответила текстом. Смените модель.
Будет ли работать база знаний на ключе altrouter?
Частично. В Dify — в режиме Economical, который ищет по ключевым словам и не требует эмбеддингов. Режиму High Quality в Dify и базе знаний Cherry Studio нужна модель эмбеддингов, а её у нас нет, для этого понадобится второй провайдер.