Как я составлял рейтинг
Три показателя — именно в таком порядке.
- Качество — Elo из Artificial Analysis Image Arena, где пользователи выбирают одно из двух изображений, созданных по одному и тому же запросу, не зная, какая модель создала какое изображение. Это самый объективный из доступных нам показателей. Но есть важная оговорка: Elo отражает среднее предпочтение людей, а не эффективность в вашей конкретной задаче. Модель, побеждающая в создании портретов, может проиграть в типографике.
- Цена — взята с актуальной страницы каждой модели на GPT Proto в день написания статьи. Цены на API изображений часто меняются; проверьте страницу, прежде чем закладывать в бюджет цифру из статьи в блоге.
- Интеграция — авторизация, синхронный или асинхронный режим, обработка ошибок. Это та часть, которую большинство списков пропускает, но с которой вы столкнётесь в первый же день.
Таков мой подход, но не абсолютная истина. Если для вас главный критерий — «самые дешёвые пиксели, которые не выглядят сломанными», переходите сразу к нижней части таблицы.
Сравнение с первого взгляда
| Модель |
Поставщик |
Arena Elo |
Цена GPT Proto |
Тарификация |
Лучше всего подходит для |
| GPT Image 2 |
OpenAI |
1339 |
$6.4 / $24 за 1M токенов |
по счётчику |
Максимальное качество, отрисовка текста |
| GPT Image 1.5 |
OpenAI |
1265 |
$5.6 / $22.4 за 1M токенов |
по счётчику |
Почти флагманское качество, более доступная модель GPT |
| Nano Banana Pro (Gemini 3 Pro Image) |
Google |
высшая категория* |
$0.0804 / изображение |
за изображение |
Профессиональные материалы в 4K |
| Nano Banana 2 (Gemini 3.1 Flash Image) |
Google |
1255 |
$0.0402 / изображение |
за изображение |
Большие объёмы, лучшее соотношение цены и качества |
| Seedream 5.0 |
ByteDance |
уровень топ-9* |
$0.0298 / изображение |
за изображение |
Фотореализм, высокое исходное разрешение |
| Wan 2.5 |
Alibaba |
пока не ранжируется |
$0.027 / изображение |
за изображение |
Многоязычные запросы, негативные запросы |
| Kling Image O1 |
Kling |
пока не ранжируется |
$0.0224 / изображение |
за изображение |
Самый дешёвый пригодный вариант, кинематографичные детали |
* Nano Banana Pro и Seedream 5.0 на момент написания статьи не были представлены отдельными записями в рейтинге Arena; их родственные и предшествующие модели находятся в высшей категории. Я указал это, а не стал приписывать им чужой показатель.
В таблице есть два столбца, которым остальные списки не уделяют внимания. Тарификация чётко разделяет модели: GPT Image взимает плату за токены, поэтому стоимость одного изображения меняется в зависимости от размера и качества и действительно трудно прогнозируется при больших объёмах. Остальные пять моделей используют фиксированную цену за изображение — скучно, но именно этого и хочет ваш финансовый отдел. Кроме того, каждая указанная выше цена GPT Proto ниже рыночной ориентировочной цены модели, поэтому «дешевле» здесь впервые подтверждается цифрами, а не является рекламным лозунгом.
Семь моделей
1. GPT Image 2 — модель, которую нужно превзойти
GPT Image 2 лидирует в Text-to-Image Arena от Artificial Analysis с показателем Elo 1339 примерно в 11 480 слепых сравнениях. Это не небольшое преимущество. Модель уверенно опережает остальных, а её сильные стороны — отрисовка текста и следование инструкциям. OpenAI выпустила её 21 апреля 2026 года.
За это качество приходится платить — и сразу в двух смыслах. Во-первых, на GPT Proto модель тарифицируется по токенам: $6.4 за 1M входных токенов и $24 за 1M выходных токенов. Поэтому изображение высокого качества размером 1024×1024 стоит дороже быстрого черновика, а расходы на одно изображение меняются при каждом изменении размера и качества. Во-вторых, сложным запросам может потребоваться до двух минут — нормально для пакетной задачи, но неприятно, если пользователь ждёт результат после нажатия кнопки.
Однако одна точка трения здесь исчезает. При прямом подключении семейство GPT Image требует пройти OpenAI's API Organization Verification до первого вызова. Через GPT Proto достаточно авторизоваться ключом платформы, полностью пропустив этот этап.
Лучше всего подходит для: главного изображения, постера кампании и всего, где один отличный результат важнее десяти дешёвых. Цена: $6.4 / $24 за 1M токенов. Страница: gpt-image-2.

2. GPT Image 1.5 — почти то же качество за меньшие деньги
GPT Image 1.5 занимает второе место в рейтинге с показателем Elo 1265, оставаясь совсем недалеко от преемника. На GPT Proto она работает по цене $5.6 / $22.4 за 1M токенов — дешевле GPT Image 2 по обоим направлениям. Если вы уже используете формат изображений OpenAI и вам не нужно абсолютное первое место, это практичный выбор.
Но есть нюанс: модель использует ту же тарификацию по счётчику, поэтому непредсказуемость бюджетирования сохраняется. Вы меняете немного качества на немного меньшую стоимость, но не избавляетесь от оплаты за токены.
Лучше всего подходит для: команд, которым нужны результаты и стабильность семейства GPT без флагманской цены. Цена: $5.6 / $22.4 за 1M токенов. Страница: gpt-image-1.5.
3. Nano Banana Pro (Gemini 3 Pro Image) — специалист по 4K
Gemini 3 Pro Image Preview от Google — модель, которую сообщество называет Nano Banana Pro, — создана для производства профессиональных материалов и использует рассуждения, оптимизированные для сложных композиций. Она создаёт изображения в разрешениях 1K, 2K и 4K, принимает до 14 референсных изображений, а в протестированных мной запросах сохраняла детали кожи, волос и освещения, которые flash-модели размывают при сильном увеличении.
Это самая дорогая из двух моделей Gemini — $0.0804 за изображение, примерно вдвое дороже Nano Banana 2. Вы платите за максимальное разрешение и рассуждения. Для миниатюры или публикации в соцсетях это переплата; для ключевого визуала в разрешении для печати — нет.
Лучше всего подходит для: вывода в 4K, печати и всего, что вы будете рассматривать с увеличением. Цена: $0.0804 / изображение. Страница: gemini-3-pro-image-preview.

4. Nano Banana 2 (Gemini 3.1 Flash Image) — лучший вариант по соотношению цены и качества
Именно к этой модели я обращаюсь в первую очередь. Gemini 3.1 Flash Image Preview имеет показатель Elo 1255 — четвёртое место в общем рейтинге, выше большинства моделей — при цене $0.0402 за изображение. Соотношение качества в рейтинге и цены здесь лучшее в списке, причём с большим отрывом.
У неё также самая гибкая спецификация: разрешения от 0.5K до 4K, до 14 референсных изображений, сверхширокие и сверхвысокие соотношения сторон (1:4, 4:1, 1:8, 8:1), которых нет ни у одной другой модели в этом списке, а также привязка к Google Image Search для фактических объектов.
Честное ограничение: на уровне Flash иногда получается результат, который на 90% соответствует задаче и требует повторной генерации, что уменьшает ценовое преимущество на сложных запросах. Но для больших объёмов, где можно позволить одну повторную попытку, модель всё равно выигрывает по стоимости.
Лучше всего подходит для: генерации больших объёмов, баннеров и всего, где главным показателем является цена хорошего изображения. Цена: $0.0402 / изображение. Страница: gemini-3.1-flash-image-preview.
5. Seedream 5.0 — фотореализм в нижней части ценового диапазона
Seedream 5.0 от ByteDance по умолчанию создаёт изображения в высоком исходном разрешении (в примере конфигурации используется размер 2227×3183) и делает сильный акцент на фотореализме и культурных нюансах. При цене $0.0298 за изображение это одна из самых дешёвых действительно качественных моделей в списке. Западные списки обычно полностью игнорируют линейку Seedream; это их потеря и пробел, который призвана закрыть эта статья.
Нужно учитывать две особенности. С точки зрения интеграции Seedream работает в асинхронном режиме: вы отправляете задачу и опрашиваете систему для получения результата — на один шаг больше, чем у синхронных моделей (код приведён ниже). Кроме того, каждый ответ содержит поле has_nsfw_contents, полезное для модерации, но означающее, что фильтр контента участвует в работе независимо от вашего желания.
Лучше всего подходит для: фотореалистичных изображений, сцен для азиатского рынка и многоязычных сцен, генерации больших объёмов при ограниченном бюджете. Цена: $0.0298 / изображение. Страница: seedream-5-0-260128.

6. Wan 2.5 — многоязычный вариант
Wan 2.5 от Alibaba пока не имеет отдельного места в Arena, поэтому я не буду приписывать ей показатель качества, которого нет. Согласно странице модели, она предлагает переключатель расширения запроса и поле негативного запроса — настоящие элементы управления, которых нет у закрытых флагманских моделей, — а также эффективную обработку многоязычных запросов благодаря наследию Qwen. При цене $0.027 за изображение она находится почти у нижней границы списка.
Компромисс: мало независимых сравнительных тестов. Я могу сказать, что на протестированных мной запросах модель создавала чистые и управляемые результаты, но пока не могу сослаться на независимый Elo в подтверждение. Считайте её полезной универсальной моделью, а не доказанным лидером рейтинга.
Лучше всего подходит для: запросов не на английском языке, рабочих процессов с негативными запросами и бюджетной генерации. Цена: $0.027 / изображение. Страница: wan-2.5.
7. Kling Image O1 — самый дешёвый вариант, который не выглядит дешёвым
При цене $0.0224 за изображение Kling Image O1 — самая дешёвая модель в списке, и своё место она заслуживает не только за счёт низкой цены. Вариант O1 использует рассуждения для более качественной обработки сложных запросов с множеством элементов, а также хорошо справляется с кинематографичным освещением и архитектурными деталями.
Та же оговорка, что и для Wan: модель не имеет отдельного места в Arena, поэтому утверждение о качестве основано на результатах непосредственного тестирования, а не на независимой оценке. В сложных запросах — например, с пятью описаниями одной загруженной сцены — она лучше, чем я ожидал за такую цену, сохраняла пространственную согласованность.
Лучше всего подходит для: кинематографичных сцен, сложных запросов и самых ограниченных бюджетов. Цена: $0.0224 / изображение. Страница: kling-image-o1.
Качество и цена на одном графике
Если сопоставить два главных показателя, картина становится ясной:
- Высшее качество и высокая цена: GPT Image 2 (Elo 1339, оплата по счётчику) и Nano Banana Pro ($0.0804). Их выбирают, когда результат и есть продукт.
- Оптимальное соотношение: Nano Banana 2 (Elo 1255 при цене $0.0402) — явный лидер: высокое место в рейтинге при цене ниже $0.05. GPT Image 1.5 (Elo 1265, оплата по счётчику) тоже относится к этой категории, если размеры изображений остаются умеренными.
- Нижняя ценовая граница при достаточной мощности: Kling O1 ($0.0224), Wan 2.5 ($0.027), Seedream 5.0 ($0.0298) — все дешевле трёх центов, все достаточно хороши для продакшена, но ни у одной нет независимого показателя высшей категории.
Если свести всё к одному предложению: платите за GPT Image 2, когда изображение является результатом работы, используйте Nano Banana 2 для всего остального, а при больших объёмах переходите на Kling или Seedream.
Политика контента и модерация: что разрешает каждая модель
Это критерий, которого другие списки избегают, но он действительно важен при выборе. Модель, которая отказывается создавать каталог купальников, рекламу пива или ключевой арт для хоррор-игры, непригодна для запуска независимо от показателя Elo.
Перед выбором стоит знать несколько конкретных различий:
- GPT Image использует обязательную модерацию, а прямой API закрывает всё семейство моделей до прохождения проверки организации. Из семи моделей она наиболее строгая в отношении пограничных коммерческих запросов.
- Seedream 5.0 возвращает флаг
has_nsfw_contents в каждом ответе — фильтр контента всегда участвует в работе, и это может быть как преимуществом, так и ограничением, которое нужно учитывать в архитектуре.
- Для всех моделей на GPT Proto заблокированный запрос возвращается как ошибка политики контента 503 (исходный статус — 400), поэтому её можно корректно перехватить и перенаправить запрос, не пытаясь угадывать, почему задача завершилась с ошибкой.
Если вашему сценарию нужен менее ограниченный доступ под контролем разработчика — например, такой уровень API без цензуры, который иногда требуется для законной коммерческой работы, связанной со взрослыми темами, — этот вопрос нужно оценивать для каждой модели отдельно с учётом её условий, а не искать ответ в одном рейтинге. Для выбора вывод проще: строгость модерации различается у разных моделей и должна оцениваться наряду с качеством и ценой.
Какую модель выбрать?
- Вам нужно лучшее изображение, а цена вторична → GPT Image 2. Примите оплату по счётчику и задержки при сложных запросах.
- Вы генерируете большие объёмы, и главным показателем является цена хорошего изображения → Nano Banana 2. Лучшее соотношение в списке.
- Вам нужно разрешение 4K или качество для печати → Nano Banana Pro.
- Бюджет ограничен, но нельзя выпускать плохие результаты → Kling Image O1 или Seedream 5.0.
- Ваши запросы не на английском языке или вам нужны негативные запросы → Wan 2.5; для фотореализма альтернативой будет Seedream 5.0.
- Вам нужны результаты семейства OpenAI без флагманской цены → GPT Image 1.5.
Как получить доступ ко всем семи моделям через один API
Именно здесь «лучший API» отличается от «лучшей модели». На GPT Proto эти семь моделей работают через один ключ и два одинаковых эндпоинта. Для смены модели достаточно изменить одну строку.
Авторизация выполняется с помощью обычного API-ключа в заголовке Authorization — без префикса Bearer:
Authorization: GPTPROTO_API_KEY
Синхронный режим (совместимый с OpenAI)
Эндпоинт /v1/images/generations возвращает изображение в ответе. Для смены модели измените строку model — вот и вся миграция:
import requests
import base64
resp = requests.post(
"https://gptproto.com/v1/images/generations",
headers={
"Authorization": "GPTPROTO_API_KEY",
"Content-Type": "application/json",
},
json={
"model": "gemini-3.1-flash-image-preview", # swap to "gpt-image-2", "gemini-3-pro-image-preview", ...
"prompt": "An editorial product photo of a matte black camera on red lacquer",
"size": "16:9",
},
)
data = resp.json()
b64 = data["data"][0]["b64_json"]
with open("output.png", "wb") as f:
f.write(base64.b64decode(b64))
Ответ также содержит объект usage с количеством токенов — именно так можно сверять расходы на модели GPT Image с оплатой по счётчику. Обработка размеров различается у моделей: линейка Gemini принимает соотношения сторон вроде 16:9, тогда как GPT Image использует размеры в пикселях. При смене модели проверьте её страницу.
Асинхронный режим (отправка задачи и опрос)
Модели на основе технологий ByteDance, например Seedream 5.0, работают по пути /api/v3/: вы отправляете задачу, получаете id и опрашиваете систему до появления результата.
import requests
import time
submit = requests.post(
"https://gptproto.com/api/v3/bytedance/seedream-5-0-260128/text-to-image",
headers={
"Authorization": "GPTPROTO_API_KEY",
"Content-Type": "application/json",
},
json={
"prompt": "Cute character wallpaper for a phone lock screen, soft studio lighting",
"size": "2227*3183",
"enable_sync_mode": False,
},
).json()
get_url = submit["data"]["urls"]["get"]
while True:
result = requests.get(
get_url,
headers={"Authorization": "GPTPROTO_API_KEY"},
).json()
if result["data"]["status"] == "completed":
print(result["data"]["outputs"])
break
time.sleep(2)
Ошибки, с которыми вы действительно столкнётесь
| Код |
Значение |
Что делать |
| 401 |
API-ключ отсутствует или недействителен |
Проверьте заголовок Authorization |
| 403 |
Нет доступа или недостаточно средств |
Пополните баланс или проверьте область действия ключа |
| 429 |
Превышен лимит запросов |
Сделайте паузу и повторите запрос |
| 503 |
Блокировка по политике контента (исходный статус 400) |
Перехватите ошибку, перенаправьте запрос или переформулируйте его |
Матрица возможностей Gemini (по документации)
| Возможность |
Gemini 2.5 Flash |
Gemini 3.1 Flash (Nano Banana 2) |
Gemini 3 Pro (Nano Banana Pro) |
| Разрешения |
1K |
0.5K, 1K, 2K, 4K |
1K, 2K, 4K |
| Максимум референсных изображений |
3 |
14 |
14 |
| Сверхширокие соотношения сторон |
— |
1:4, 4:1, 1:8, 8:1 |
— |
| Привязка к поиску изображений |
— |
да |
— |
Именно такая схема миграции — изменить одну строку, сохранить клиент и переключаться между поставщиками, когда один из них недоступен, — является настоящей причиной использовать агрегатор для вызова моделей изображений вместо интеграции четырёх SDK. Начните с каталога моделей и главной страницы GPT Proto, чтобы ознакомиться со всем набором.
Цены и рейтинги Arena отражают данные актуальных страниц моделей и Artificial Analysis Image Arena на момент написания статьи. И те и другие часто меняются — проверяйте страницы моделей по ссылкам перед планированием бюджета.