altrouter.ai
← Блог

Нейросеть для генерации изображений: 13 моделей

· 8 минут чтения · обновлено

Коротко

Запрос «нейросеть для генерации изображений» почти всегда означает одно из двух: либо человек хочет разово нарисовать картинку и ищет бесплатный онлайн-сервис, либо ему нужно делать это регулярно и программно — для карточек товаров, обложек, иллюстраций, превью.

Если вы в первой группе — вам, скорее всего, хватит бесплатных сервисов вроде Шедеврума или Кандинского, и эта статья вам не очень нужна. Сказать об этом честно дешевле, чем потом объяснять, почему вы не нашли у нас кнопку «нарисовать бесплатно без регистрации».

Эта статья — для второй группы. Разберём 13 моделей, которые доступны в altrouter через один API, по задачам и по цене за картинку. Без списка «топ-10 лучших нейросетей»: универсально лучшей модели не существует, а вот измеримая разница в цене — в 7 раз между самой дешёвой и самой дорогой — существует.

Все 13 моделей и цены

Цена — за одну картинку, это наша цена (она ниже официальной, процент скидки у каждой модели свой). Все 13 умеют и генерацию по тексту, и редактирование по референсу.

МодельПровайдер$/картинкаСкидка
qwen-imageAlibaba0.0175−50%
seedream-v4ByteDance0.030−15%
flux-2-proBlack Forest0.030−15%
grok-imaginexAI0.030−20%
wan-2.7Alibaba0.030−25%
nano-bananaGoogle0.035−10%
nano-banana-fastGoogle0.035−10%
seedream-5-liteByteDance0.035−15%
gpt-image-2OpenAI0.037−30%
seedream-4.5ByteDance0.040−15%
seedream-5-proByteDance0.045−16%
nano-banana-2Google0.071−30%
nano-banana-proGoogle0.121−10%

Цены меняются вслед за провайдерами. Источник правды — каталог /models/, а не этот текст: если числа тут разойдутся с каталогом, верьте каталогу.

Фотореализм

Заявленный профиль моделей, которые провайдеры позиционируют на фотореализм:

  • flux-2-pro — Black Forest Labs заявляет топовый фотореализм и точный текст. $0.030.
  • seedream-v4 — фотореалистичная генерация и редактирование от ByteDance. $0.030.
  • nano-banana-2 и nano-banana-pro — второе поколение и Pro-версия Google, выше качество и детализация. $0.071 и $0.121.

Честно про ограничение этого раздела: мы не публикуем собственные слепые тесты качества и не будем притворяться, что «flux лучше seedream на 12%». Оба стоят одинаково ($0.030), оба заявлены на фотореализм — прогоните свои 10 промтов на обоих и решите сами. Это дешевле спора: 20 картинок обойдутся в $0.60.

Текст на картинке

Это та задача, где модели расходятся заметнее всего, и где провайдеры не стесняются заявлять её отдельно:

  • qwen-image — «сильный текст на картинке», и при этом самая дешёвая модель каталога ($0.0175).
  • gpt-image-2 — «точный рендер текста» от OpenAI, $0.037.
  • flux-2-pro — точный текст заявлен вместе с фотореализмом, $0.030.

Если вам нужны баннеры, обложки или карточки с надписями — начинайте с этих трёх. Кириллица у любой модели даётся тяжелее латиницы, так что тестируйте именно на своих русских надписях, а не на английских примерах из промо-галерей.

Редактирование по референсу

Отдельный сервис для редактирования не нужен: все 13 моделей принимают референс. Передаёте картинку в поле image (URL или base64) — роутер сам выберет edit-вариант модели:

{
  "model": "nano-banana",
  "prompt": "make the sky purple",
  "image": ["https://example.com/photo.jpg"]
}

Это же закрывает популярный запрос «генерация изображений по фото»: технически это и есть редактирование по референсу.

Богаче всего по ручкам управления — qwen-image: у неё есть negative_prompt, num_inference_steps, guidance_scale и seed. У Google-моделей набор аскетичнее: aspect_ratio, resolution, seed. Точный список параметров каждой модели — на её странице в каталоге и в /docs/parameters/.

Дёшево и массово: считаем на 1000 картинок

Вот где разница перестаёт быть абстрактной. Тысяча картинок:

Модель1000 картинок
qwen-image$17.50
seedream-v4 / flux-2-pro / grok-imagine / wan-2.7$30
nano-banana / nano-banana-fast / seedream-5-lite~$35
gpt-image-2$37
seedream-4.5$40
seedream-5-pro$45
nano-banana-2$71
nano-banana-pro$121

Для потокового конвейера — превью, черновики, A/B-варианты — qwen-image дешевле nano-banana-pro в 7 раз. Для обложки, которую увидят сто тысяч человек, экономия в $0.10 не имеет смысла. Здравый паттерн: массовый черновик на дешёвой модели, финал — на дорогой.

Ловушка 4K: разрешение стоит дороже, чем кажется

Это то, что обычно не пишут в обзорах, а деньги оно ест реально. Тир задаётся параметром resolution, и цена за 4K — не та, что вы видите на карточке модели: карточка показывает базовый тир.

Модель2K4KВо сколько раз
gpt-image-2$0.037$0.080×2.2
nano-banana-2$0.071$0.106×1.5
nano-banana-pro$0.121$0.216×1.8

Тысяча картинок в 4K на nano-banana-pro — это примерно $216 против $121 в 2K. Разница не разорительная, но и не нулевая: включайте 4K осознанно, а не «пусть будет получше».

Отдельная оговорка про линейку Seedream и qwen-image: они считаются по фактическому расходу провайдера, а не по фиксированной ставке за картинку. Точную цену 4K там мы назвать честно не можем — она станет известна по факту генерации и будет видна в логах расхода. Если 4K нужен массово, прогоните десяток картинок и посмотрите фактический счёт, прежде чем планировать бюджет.

Как это выглядит в коде

Эндпоинт OpenAI-совместимый, так что подойдёт обычная библиотека openai — меняются только base_url и ключ:

from openai import OpenAI

client = OpenAI(
    base_url="https://api.altrouter.ai/v1",
    api_key="ar-...",
)

img = client.images.generate(
    model="qwen-image",
    prompt="a red fox in the snow, cinematic",
)
print(img.data[0].url)

Чтобы сравнить модели, меняете одну строку — model. Ключ один на все 13, отдельные аккаунты у Google, OpenAI, ByteDance и Alibaba не нужны. Оплата — карта РФ, СБП или крипта, без зарубежной карты и VPN.

За подтверждённый Telegram на баланс падает $1 — этого хватит на несколько десятков картинок, чтобы прогнать свой тест до того, как платить.

Подробности по эндпоинту — в /docs/images/.

Чего у нас нет

Чтобы вы не потратили вечер зря:

  • Нет веб-чата в стиле ChatGPT и мобильного приложения. Есть песочница в кабинете, но она за логином.
  • Нет бесплатного безлимита. Стартовый $1 за подтверждённый Telegram — это стартовый $1.
  • Нет Sora и Midjourney. Первой нет в каталоге совсем, вторая не отдаёт публичный API.
  • Внимание на wan-2.7: в этой таблице это модель для картинок. Одноимённая видео-модель называется wan-2.7-video и живёт на другом эндпоинте.

Видео у нас, кстати, есть — 7 моделей (Veo, Kling, Hailuo, Seedance, Wan) на отдельном асинхронном эндпоинте /docs/videos/. Просто это другая статья.

Как выбрать за один вечер

  1. Возьмите 5–10 своих реальных промтов, а не примеры из галерей.
  2. Прогоните их на трёх моделях под задачу: фотореализм — flux-2-pro и seedream-v4; текст на картинке — qwen-image и gpt-image-2.
  3. Посмотрите на результат и на счёт в логах кабинета. Тест из 30 картинок стоит меньше доллара.
  4. Проверьте цену в нужном вам разрешении — а не только в дефолтном.

Каталог со всеми моделями и актуальными ценами — /models/. Начать без кода можно в песочнице кабинета: регистрация через Google, Telegram или почту.

FAQ

Сколько стоит одна картинка, сгенерированная нейросетью?

От $0.0175 у qwen-image до $0.121 у nano-banana-pro — разброс почти в семь раз. Середина каталога держится в районе $0.030–0.037: столько стоят flux-2-pro, seedream-v4 и gpt-image-2.

Сколько обойдётся тысяча изображений?

$17.50 на qwen-image, около $30 на seedream-v4, flux-2-pro, grok-imagine и wan-2.7, $37 на gpt-image-2, $71 на nano-banana-2 и $121 на nano-banana-pro. Здравый паттерн — массовые черновики на дешёвой модели, финал на дорогой.

Какая модель лучше рисует текст на картинке?

Провайдеры отдельно заявляют эту способность у трёх: qwen-image (и она же самая дешёвая, $0.0175), gpt-image-2 ($0.037) и flux-2-pro ($0.030). Кириллица любой модели даётся тяжелее латиницы, поэтому тестировать нужно именно на своих русских надписях.

Правда ли, что 4K стоит дороже?

Да, и на карточке модели показан базовый тир, а не 4K. У gpt-image-2 это $0.037 против $0.080, у nano-banana-2 — $0.071 против $0.106, у nano-banana-pro — $0.121 против $0.216. Тысяча картинок в 4K на nano-banana-pro обойдётся примерно в $216 против $121.

Можно ли редактировать изображение по референсу?

Да, отдельный сервис для этого не нужен: все 13 моделей принимают референс в поле image — ссылкой или в base64, — и роутер сам выбирает вариант модели для редактирования. Это же закрывает запрос «генерация изображений по фото»: технически это и есть редактирование по референсу.

Каких моделей для картинок у вас нет?

Sora нет в каталоге совсем, Midjourney не отдаёт публичный API. Также нет веб-чата и мобильного приложения — есть песочница в кабинете за логином. Отдельно обратите внимание: wan-2.7 в каталоге картинок это модель для изображений, а одноимённая видеомодель называется wan-2.7-video.