Лучшие нейросети для генерации изображений и фото: Тест 7 ИИ на одинаковых промптах
Сравнение лучших ИИ для создания изображений в 2026 году. Три одинаковых задания, оценки и разбор ошибок GPT Image 2, Nano Banana 2, Seedream 5.0 Pro и других моделей.

Выбрать лучшую нейросеть для генерации изображений по рекламным примерам почти невозможно: на них обычно показывают удачные работы и редко видно, как модель ведет себя на длинном промпте, точном тексте, сложной анатомии или композиции из десятка обязательных деталей. Поэтому я проверил семь актуальных генераторов на трех одинаковых заданиях — предметной рекламе, фотореалистичной городской фотографии и панорамном концепт-арте.
В тест вошли GPT Image 2, Nano Banana 2, Seedream 5.0 Pro, Midjourney, Flux 2, Nano Banana Pro и Qwen Image 3.0. Для каждой нейросети использовался один и тот же промпт без упрощений и персональной адаптации. Я оценивал не только то, насколько эффектно выглядит готовая картинка, но и соблюдение инструкции, корректность текста, реализм материалов и людей, анатомию, пространственную логику, заданный формат и количество ошибок, которые пришлось бы исправлять перед реальным использованием.
Такое сравнение генераторов изображений оказалось показательнее обычного рейтинга по одной картинке. Например, Seedream 5.0 Pro лучше всех справилась с чистым фотореализмом, Nano Banana Pro особенно хорошо показала себя в предметной съемке, а Midjourney делала эффектные изображения, но заметно свободнее обращалась с условиями промпта. Самой универсальной по итогам трех заданий стала GPT Image 2.
Лучшие ИИ для генерации изображений: результаты теста
GPT Image 2 — 9,5/10. Лучший общий результат. Точно следует сложному промпту, уверенно пишет текст и одинаково хорошо справляется с рекламой, реалистичными фото и детализированным концепт-артом.
Nano Banana 2 — 9,0/10. Самый ровный конкурент GPT Image 2: ни одного слабого теста, хорошее понимание композиции, текста и сложных визуальных инструкций.
Nano Banana Pro — 8,8/10. Особенно сильна в предметной генерации и изображениях с точными надписями. В сложных сценах немного уступает новой Nano Banana 2.
Flux 2 — 8,4/10. Хорошо передает стекло, свет, фактуры и коммерческую фотографию, но хуже удерживает жесткую пространственную структуру сложных сцен.
Qwen Image 3.0 — 8,2/10. Хорошо понимает длинные запросы и текст внутри изображения, однако на людях и сложной архитектуре артефакты заметнее.
Seedream 5.0 Pro — около 8,1/10. Лучший результат по фотореалистичной фотографии, особенно по лицу, коже, ткани и естественности движения. На рекламном задании и концепт-арте менее стабильна.
Midjourney — 7,0/10. Умеет создавать визуально сильные кадры, но в этом сравнении чаще остальных переосмысливала исходный запрос и хуже справилась с точным текстом.
Если нужен один универсальный ИИ для изображений без заранее известного типа задачи, по результатам теста я бы начинал с GPT Image 2 или Nano Banana 2. Для максимально естественных фотографий людей отдельно стоит попробовать Seedream 5.0 Pro, а Midjourney остается интересным вариантом для задач, где художественная интерпретация важнее буквального соблюдения технического задания.
Как я тестировал нейросети для генерации фото и изображений

Семь моделей получили три совершенно разных задания. Первое проверяло предметную фотографию, работу с физически сложными материалами и точной типографикой. Второе — анатомию, фотореализм, движение, городской фон и отражения. Третье — способность ИИ построить большое пространство со сложной архитектурой и сохранить взаимное расположение объектов.
Промпты намеренно получились подробными. Это ближе к реальной работе, чем короткое «нарисуй флакон духов» или «сделай фото девушки на улице»: при подготовке рекламы, обложки, концепта или иллюстрации обычно важно одновременно задать героя, окружение, свет, формат, композицию и детали, которые нельзя менять.
При оценке я смотрел на несколько параметров:
Насколько точно нейросеть выполняет сам промпт и не пропускает обязательные элементы.
Правильно ли передает форму предметов, перспективу, пропорции и пространственные связи.
Насколько натурально выглядят человек, лицо, руки, одежда и движение.
Правдоподобны ли стекло, вода, дерево, камень, кожа и другие материалы.
Справляется ли генератор изображений с заданным текстом без псевдобукв и лишних символов.
Сохраняет ли соотношение сторон и нужный тип композиции.
Можно ли использовать результат почти сразу или картинка требует заметной ручной доработки.
Промпт №1: рекламная фотография парфюма
Профессиональная рекламная фотография премиального унисекс-парфюма. В центре композиции стоит один прямоугольный флакон из толстого прозрачного стекла с закругленными краями. Внутри — светлая янтарная жидкость. Флакон закрыт цельной матовой крышкой из темного дерева, установленной строго по центру. Все грани, толщина стекла, уровень жидкости и соединение крышки с горлышком должны выглядеть физически правильно.
На передней стороне расположена минималистичная белая этикетка с четкой черной надписью:
NORD
EAU DE PARFUM
50 ML
Не добавлять на флакон никаких других букв, символов и декоративных элементов.
Парфюм стоит на светлом каменном подиуме, частично покрытом тонким слоем воды. Рядом лежат разрезанный бергамот, веточка кедра и несколько капель воды. Позади флакона поднимается изящный полупрозрачный всплеск, который обрамляет продукт, но не перекрывает этикетку. На поверхности видны реалистичные отражение флакона и мягкая контактная тень.
Теплый луч утреннего солнца проходит справа налево через стекло и жидкость, создавая естественные золотистые блики и световые преломления. Фон светлый, серо-бежевый, с мягким градиентом и свободным пространством по краям. Флакон полностью резкий, второстепенные детали слегка размыты.
Съемка в профессиональной студии, камера на уровне середины флакона, объектив 85 мм, премиальная предметная фотография для рекламной кампании косметического бренда. Чистая коммерческая композиция, реалистичное стекло, вода, дерево, камень и цитрус, естественная цветокоррекция, высокая детализация. Без людей, рук, рамок, логотипов, водяных знаков и дополнительного текста. Горизонтальный формат 16:9.
Здесь красивого флакона недостаточно. Генератор должен одновременно выдержать геометрию прозрачного предмета, корректно провести свет через стекло и жидкость, сохранить рекламную композицию и без ошибок напечатать три заданные строки. Поэтому даже визуально привлекательная работа заметно теряла баллы, если надпись превращалась в псевдотекст или модель самостоятельно меняла сцену.
Промпт №2: фотореалистичная фотография в Санкт-Петербурге
Фотореалистичная динамичная уличная фотография в Санкт-Петербурге. Молодая женщина быстро переходит мокрую улицу после только что закончившегося летнего дождя. На ней яркий кораллово-красный плащ необычного асимметричного кроя, темные брюки и кожаные ботинки. Плащ и волосы естественно движутся от ветра и быстрого шага. Женщина не позирует и смотрит немного в сторону от камеры.
В кадре полностью видна ее фигура, включая обе руки и обе ноги. На заднем плане — узнаваемая историческая архитектура Санкт-Петербурга, проезжающий автомобиль и несколько прохожих. В лужах отражаются женщина, фасады, теплый свет витрин и фрагменты неба. После дождя сквозь разрывы между крупными кучевыми облаками пробивается низкое золотистое солнце. Теплый солнечный свет сочетается с холодными сине-серыми тенями и мокрым асфальтом.
Съемка на уровне глаз, объектив 35 мм, легкое размытие движения на ногах и фоне, лицо остается резким. Естественные пропорции тела, правдоподобные кисти и пальцы, реалистичная кожа, документальная городская фотография, без глянцевой постановочности. Без текста, водяных знаков, рамок и логотипов. Соотношение сторон 16:9.
Это задание проверяло те места, где признаки генерации обычно видны быстрее всего: лицо, руки, положение ног, характер шага, взаимодействие человека с дорогой, отражения и случайных прохожих на заднем плане. Дополнительная сложность — кадр должен был оставаться непостановочным. Красивый fashion-портрет в центре улицы не считался полным выполнением задания, даже если визуально выглядел эффектно.
Промпт №3: эльфийский город внутри гигантского дерева
Панорамный реалистичный концепт-арт огромного эльфийского города, построенного внутри живого дерева размером с гору. Корни и ствол дерева вросли в стены гигантского скалистого каньона. На разных уровнях расположены светлые дворцы, башни и террасы, архитектура выглядит частью дерева, а не отдельными зданиями.
Между скалами и ветвями проходят несколько длинных витиеватых подвесных мостов. На ближайшем мосту видны три маленькие фигуры путников, подчеркивающие огромный масштаб города. Из верхних террас стекают водопады, которые исчезают в плотном слое облаков далеко внизу.
Широкая панорамная композиция, выраженные передний, средний и дальний планы, утренний боковой свет, естественная атмосферная перспектива, реалистичные камень, древесная кора, вода и растительность. Величественная, но правдоподобная архитектура, высокая детализация, кинематографический концепт-арт. Без текста, рамок, интерфейсов и логотипов. Соотношение сторон 16:9.
В этом тесте я оценивал уже не отдельные мелкие детали, а способность модели удержать идею целиком. Город должен быть частью огромного дерева, дерево — частью каньона, мосты должны связывать уровни, а водопады и три маленьких путника — усиливать ощущение масштаба. Если ИИ рисовал красивый замок рядом с деревом, результат выглядел эффектно, но центральный смысл промпта терялся.
Три задания заодно показывают, почему нет смысла выбирать нейросеть только по одному удачному примеру. Хороший ИИ для фото может оказаться заметно слабее в сложном концепт-арте, а модель с великолепной художественной стилизацией — проиграть на рекламном макете с точным текстом.
Обзоры нейросетей и результаты трех тестов:
GPT Image 2 — 9,5/10
GPT Image 2 — модель OpenAI для генерации и редактирования изображений по текстовому запросу и исходным картинкам. Ее сильная сторона хорошо видна именно на сложных технических заданиях: модель удерживает длинный контекст, понимает взаимосвязь деталей сцены и заметно реже превращает второстепенные требования в случайные элементы. Это полезно для рекламных макетов, обложек, предметной съемки, визуалов с надписями и концепт-арта, где недостаточно получить просто красивую картинку.
В сумме трех испытаний GPT Image 2 набрала 9,5 балла — лучший результат сравнения. Модель не победила абсолютно во всех отдельных дисциплинах, зато нигде не показала явной слабости. Именно такая стабильность делает ее наиболее универсальным вариантом среди протестированных ИИ для генерации изображений.
Флакон NORD: точный текст и правдоподобные материалы

Оценка — 9,6/10. GPT Image 2 без ошибок воспроизвела все три строки на этикетке: NORD, EAU DE PARFUM и 50 ML. При этом надпись не стала отдельным декоративным элементом — она нормально легла на плоскость этикетки, а геометрия самого флакона осталась убедительной.
Хорошо получились и материалы. Толстое прозрачное стекло действительно ощущается стеклом, через янтарную жидкость проходит теплый свет, деревянная крышка отличается по фактуре от камня, а вода не выглядит приклеенной поверх сцены. Сохранились подиум, цитрус, веточка кедра, всплеск и отражение. В результате это уже не просто нейросетевой натюрморт, а изображение, близкое по структуре к готовой рекламной фотографии.
Петербург после дождя: сложная сцена без развалившегося фона

Оценка — 9,3/10. По чистой естественности человека GPT Image 2 немного уступила Seedream 5.0 Pro, зато лучше собрала окружение. В кадре появились мокрый асфальт, автомобили, прохожие, отражения, сложное сочетание теплого солнечного света и холодных теней. Петербург читается заметнее благодаря узнаваемому Исаакиевскому собору.
Анатомия героини корректная, руки и ноги не ломаются, лицо остается резким, а задний план насыщен деталями без очевидного визуального хаоса. Недочет тоже виден: женщина выглядит чуть более постановочно, чем требовал промпт, и скорее идет вдоль улицы, чем быстро ее пересекает. Но как фотореалистичная городская сцена результат остается одним из самых сильных.
Эльфийский мегаполис: лучший масштаб и пространственная логика

Оценка — 9,7/10. На самом сложном композиционном задании GPT Image 2 показала лучший результат всего теста. Модель не просто разместила дворцы рядом с большим деревом, а связала дерево, каньон и архитектуру в единое пространство. Корни участвуют в конструкции города, здания распределены по нескольким уровням, а водопады уходят в облачную пропасть.
Хорошо читаются передний, средний и дальний планы. Даже небольшие постройки и мосты сохраняют структуру, поэтому масштаб не рассыпается при внимательном просмотре. Не каждый переход получился именно подвесным, но это локальное отклонение не ломает основную идею. По глубине, композиции и соответствию исходному замыслу это самый цельный эльфийский город среди семи вариантов.
GPT Image 2 в итоге лучше всего подходит для случая, когда заранее неизвестно, что придется генерировать завтра: рекламный продукт, фотореалистичное фото, сложную иллюстрацию или изображение с надписью. Она не всегда делает самый стилизованный кадр, зато надежнее остальных сохраняет требования промпта.
Перейти к нейросети GPT Image 2
Nano Banana 2 — 9,0/10
Nano Banana 2 — генератор изображений Google из семейства Gemini, рассчитанный не только на создание картинки с нуля, но и на последующее редактирование, работу с референсами и сохранение объектов между итерациями. Модель хорошо понимает естественные текстовые команды и подходит для тех случаев, когда изображение постепенно доводят до нужного вида, а не пытаются получить идеальный результат одним запросом.
В тестировании Nano Banana 2 показала самую ровную серию после GPT Image 2. Итог — 9,0 балла. У нее не было абсолютной победы в отдельных заданиях, зато все три результата остались в сильной зоне: 9,0, 8,8 и 9,1. Для универсального генератора изображений это важнее одного эффектного попадания.
Предметная реклама: технически чисто, но без лишнего риска

Оценка — 9,0/10. Nano Banana 2 правильно написала текст на флаконе, сохранила форму продукта и не потеряла обязательные предметы. Стекло, жидкость, дерево и камень различаются по фактуре, а сама сцена выглядит как коммерческая предметная съемка, а не случайный 3D-рендер.
Основное отличие от лидеров — композиция получилась более безопасной. Модель выполнила задание аккуратно, но не дала настолько выразительного света и взаимодействия воды с флаконом, как лучшие варианты. Для реального рекламного макета это, скорее, удобная исходная точка: технических проблем мало, а характер сцены можно усиливать следующими правками.
Дождливый Петербург: хорошее движение и несколько лишних деталей

Оценка — 8,8/10. Nano Banana 2 убедительно передала сочетание мокрого города, теплого солнца после дождя и движения человека. Плащ и волосы выглядят динамично, улица отражает свет, а сцена в целом не ощущается полностью статичной.
Ошибки появляются там, где модель начинает самостоятельно дополнять историю. У девушки возникли сумки, которых в промпте не было. На зданиях заметен псевдотекст — типичный артефакт, который сразу выдает генерацию при увеличении изображения. При этом лицо, фигура и сама городская среда остаются достаточно естественными, поэтому результат получил высокий балл.
Город в дереве: почти все условия собраны в одной сцене

Оценка — 9,1/10. Именно в концепт-арте Nano Banana 2 приблизилась к GPT Image 2 сильнее всего. Модель хорошо соединила корни гигантского дерева с архитектурой, сохранила многоуровневый город, водопады, глубокий каньон и сложное освещение.
Масштаб читается сразу, а архитектура не выглядит просто набором отдельных башен. Часть переходов, правда, превратилась из подвесных мостов в более массивные каменные эстакады. На дальнем плане встречаются повторяющиеся постройки. Но центральная идея не потеряна, а это в таком задании важнее отдельных декоративных неточностей.
Nano Banana 2 стоит рассматривать как одну из лучших нейросетей для создания фото, рекламных визуалов и иллюстраций, если нужен один инструмент для разных типов контента. По итогам теста это наиболее близкая альтернатива GPT Image 2.
Перейти к нейросети Nano Banana 2
Seedream 5.0 Pro — около 8,1/10
Seedream 5.0 Pro — мультимодальная модель ByteDance для генерации и редактирования изображений. Ее особенно интересно использовать там, где критична фотографическая естественность: лица, кожа, волосы, одежда, освещение и сцены, которые не должны выглядеть как глянцевый AI-рендер. Модель также рассчитана на работу со сложными макетами и визуальными инструкциями, но наш тест показал заметную разницу между разными жанрами.
Seedream получила около 8,1 балла в среднем. Такая цифра немного обманчива: именно эта нейросеть выиграла самый важный тест на чистый фотореализм, но заметно уступила лидерам на предметной рекламе и сложном концепт-арте.
Парфюм: хороший флакон, но часть постановки исчезла

Оценка — 7,7/10. Сам продукт Seedream сделала правдоподобно. Форма флакона, стекло и янтарная жидкость выглядят реалистично, поэтому при беглом просмотре изображение производит хорошее впечатление.
Проблема обнаруживается при сравнении с исходным заданием. Модель заметно упростила композицию: пропал динамичный всплеск, потерялся каменный подиум, а надпись EAU DE PARFUM была разбита на несколько строк. Для свободной предметной фотографии это не катастрофа, но при генерации рекламы по готовому техническому заданию такие изменения уже требуют переделки.
Уличная фотография: самый естественный человек из семи

Оценка — 9,6/10. Это лучший результат Seedream и одновременно первое место среди всех моделей во втором тесте. Лицо, кожа, волосы и ткань плаща выглядят естественно, а движение ног не создает характерного ощущения искусственно собранной позы. Кадр меньше остальных похож на изображение, сгенерированное нейросетью.
Особенно хорошо работает общая непостановочность. Женщина не выглядит моделью, специально вставшей в центр кадра. При этом есть два отклонения от задания: сам плащ оказался довольно обычным, хотя требовался необычный асимметричный крой, а Петербург не считывается настолько явно, как в варианте GPT Image 2.
Фэнтезийная панорама: детализация есть, глубины не хватает

Оценка — около 7,0/10. На концепт-арте преимущество Seedream в фотографической естественности уже не помогает. Изображение получилось заметно более плоским: передний, средний и дальний планы разделены слабее, поэтому огромный город не дает ожидаемого ощущения масштаба.
Главные элементы сцены присутствуют, но связь между архитектурой, каньоном и деревом выглядит менее убедительно, чем у GPT Image 2 и Nano Banana 2. Для красивой фэнтезийной иллюстрации результат приемлем, но сложное worldbuilding-задание модель выполнила слабее.
Seedream 5.0 Pro я бы выбирал прежде всего для фотореалистичных людей, lifestyle-сцен, fashion, портретов и изображений, где важнее всего натуральная кожа, ткань, свет и ощущение настоящей фотографии. В нашем сравнении именно здесь модель раскрылась лучше всего.
Перейти к нейросети Seedream 5.0 Pro
Midjourney — 7,0/10
Midjourney — один из самых известных генераторов изображений, ориентированный на художественное качество, стилизацию и визуально выразительные композиции. В 2026 году основная линейка перешла на V8.2, а инструменты редактирования позволяют менять отдельные области, расширять кадр и работать с референсами. Сильная сторона Midjourney остается прежней: модель умеет быстро находить красивую визуальную интерпретацию даже там, где исходный запрос сформулирован достаточно сухо.
Но эта же свобода стала главной проблемой нашего тестирования. Если промпт воспринимать как жесткое техническое задание, Midjourney слишком часто принимает собственные художественные решения. Итоговая оценка — 7,0 балла, последнее место среди семи моделей.
Реклама парфюма: эффектный кадр вместо заданного макета

Оценка — 5,8/10. Это самый слабый отдельный результат тестирования. Midjourney не справилась с точным текстом: вместо NORD, EAU DE PARFUM и 50 ML на этикетке появился бессмысленный набор букв. Для предметной рекламы это критическая ошибка, потому что упаковку пришлось бы переделывать вручную.
На этом отклонения не заканчиваются. Светлая серо-бежевая сцена превратилась в насыщенную бирюзовую композицию, а вместо требуемого горизонтального 16:9 модель выдала квадратный кадр. Визуально картинка действительно привлекательная, но с точки зрения соответствия брифу это уже другая рекламная концепция.
Мокрая улица: красиво, но слишком похоже на fashion-съемку

Оценка — 8,2/10. На фотографии Midjourney заметно реабилитировалась. Получились атмосферный свет, красивое размытие и достаточно убедительная мокрая городская среда. Если бы задача звучала как «модная съемка после дождя», результат можно было бы оценить еще выше.
Однако промпт требовал документальной непостановочности. Вместо этого девушка оказалась практически по центру дороги, а вся композиция выглядит слишком намеренно выстроенной. Движение ног и отражение тоже вызывают вопросы при внимательном просмотре. Картинка эффектная, но не совсем та, которую просили получить.
Эльфийский город: сильная атмосфера, потерянная центральная идея

Оценка — 6,9/10. Midjourney создала красивую панораму фантастического города на скалах, но гигантское дерево перестало быть основой архитектуры. Оно оказалось на периферии и практически не связано с городом, хотя весь смысл промпта строился именно вокруг единого живого пространства.
Подвесные мосты упростились до тонких прямых переходов, а архитектура выглядит более плоской и однообразной. Если оценивать картинку без исходного задания, она производит приятное впечатление. Если проверять prompt adherence — точность следования промпту — разница с лидерами становится очевидной.
Midjourney остается сильным инструментом для постеров, атмосферных иллюстраций, moodboard, fashion, стилизации и поиска художественного направления. Но в задачах с точными надписями, жесткой компоновкой и большим количеством обязательных условий в этом тесте надежнее оказались другие нейросети.
Midjourney отличается от других ИИ специфическими требованиям к написанию промптов - для частоты эксперимента я повторил тест с переделанным промптом, описал его в конце статьи.
Перейти к нейросети Midjourney
Flux 2 — 8,4/10
Flux 2 — семейство моделей Black Forest Labs для генерации и редактирования изображений. Линейка ориентирована на качественные коммерческие визуалы, работу с референсами, реалистичные материалы, лица и управляемое изображение. Flux особенно интересно использовать в задачах, где важны свет, фактура объекта и ощущение профессионального рекламного кадра.
В трех тестах модель получила 8,4 балла. На предметной фотографии Flux 2 почти догнала лидеров, но по мере усложнения пространственной структуры результаты стали слабее. Это хорошо показывает специализацию модели: локальное качество отдельных объектов у нее выше, чем точность сборки очень сложной сцены.
Стекло, вода и свет: одна из лучших предметных генераций

Оценка — 9,1/10. Flux 2 уверенно справилась с надписью на упаковке и хорошо передала освещение. Флакон выглядит объемным, жидкость взаимодействует со светом, а рекламная сцена в целом воспринимается профессионально.
Главная претензия касается воды. В отдельных местах всплеск напоминает прозрачную пластиковую декорацию, а не жидкость, застывшую в момент съемки. Это не разрушает изображение целиком, но именно такие мелкие физические несоответствия выдают генерацию в крупной продуктовой фотографии.
Динамический портрет: кинематографично, но слишком модельно

Оценка — 8,2/10. Flux создала яркий кадр с хорошей атмосферой, мокрым асфальтом и динамикой. Цвет, свет и общая фотографическая обработка работают убедительно, поэтому на небольшом размере изображение выглядит качественно.
При увеличении проявляются более характерные признаки ИИ. Лицо немного искусственное, шаг слишком широкий, а поза напоминает специально выбранную модельную. Петербург при этом показан довольно обобщенно. Для рекламной fashion-фотографии такой результат может быть уместен, но под условие «случайный документальный кадр» он подходит хуже.
Концепт-арт: хороший мир, но не та панорамная конструкция

Оценка — 8,0/10. Flux 2 создала связную и детализированную фэнтезийную сцену. Архитектура, дерево и скалы существуют в одном пространстве, а отдельные зоны выглядят достаточно проработанными.
Но модель изменила сам масштаб городской структуры: вместо огромного многоуровневого мегаполиса получилось нечто ближе к большому дворцовому комплексу вокруг дерева. Количество путников и часть соединений мостов расходятся с промптом. Дополнительный минус — квадратное изображение вместо панорамы 16:9.
Flux 2 хорошо подходит для предметной съемки, рекламных визуалов, портретов, интерьеров и сцен с выраженным светом и фактурами. В нашем рейтинге это один из лучших генераторов для коммерческой картинки, если композиция не требует слишком сложной пространственной логики.
Nano Banana Pro — 8,8/10
Nano Banana Pro — модель Google Gemini для генерации и редактирования изображений, рассчитанная на сложные визуальные инструкции, типографику и работу с содержанием сцены. Особенно полезно, что она уверенно обращается с текстом внутри изображения: это важно для упаковки, постеров, рекламных макетов, инфографики и любых задач, где надпись является частью композиции, а не декоративным дополнением.
Средний результат Nano Banana Pro — 8,8 балла. Модель заняла второе место в тесте с флаконом и осталась сильной в двух остальных заданиях. При этом новая Nano Banana 2 в нашем сравнении оказалась немного универсальнее, особенно на сложном концепт-арте.
Точная этикетка: почти эталонный коммерческий кадр

Оценка — 9,2/10. Nano Banana Pro без ошибок написала NORD, EAU DE PARFUM и 50 ML, сохранила форму флакона и собрала чистую рекламную композицию. Стекло выглядит аккуратно, крышка находится на правильном месте, а этикетка не деформируется.
По сравнению с GPT Image 2 изображение получилось чуть более стерильным. Кроме того, всплеск воды частично упирается в верхнюю границу и выглядит как элемент, которому не хватило пространства в кадре. Но для реальной предметной съемки это один из самых пригодных результатов теста.
Городская сцена: сильный свет и странности на заднем плане

Оценка — 8,5/10. В фотографии Nano Banana Pro хорошо передала одежду, отражение и сочетание теплого света с холодным мокрым городом. Фигура главной героини собрана без серьезных анатомических ошибок.
Слабое место — естественность движения. Поза выглядит немного скованной, поэтому вместо случайного момента получается более контролируемый кадр. На заднем плане отдельные фигуры людей тоже начинают вести себя странно: при внимательном просмотре там заметнее нейросетевые артефакты.
Три путника и водопады: буквально, но чуть слишком иллюстративно

Оценка — 8,7/10. В третьем тесте Nano Banana Pro выполнила большую часть требований почти буквально. Есть огромное дерево, каньон, водопады, мосты и три путника, которые помогают считывать масштаб.
По сравнению с GPT Image 2 и Nano Banana 2 композиция получилась слишком центральной. Дальние планы мягче, материалы менее реалистичны, а сама сцена немного больше похожа на художественную иллюстрацию, чем на огромный физически убедительный мир. Тем не менее по количеству правильно выполненных условий результат остается сильным.
Nano Banana Pro особенно хорошо смотрится в задачах, где одновременно нужны изображение и типографика: упаковка, постер, рекламный креатив, карточка товара или визуальный макет. Если же нужен один генератор для максимально разных жанров, Nano Banana 2 по итогам этого тестирования оказалась немного ровнее.
Перейти к нейросети Nano Banana Pro
Qwen Image 3.0 — 8,2/10
Qwen Image 3.0 — третье поколение генератора изображений Qwen, рассчитанное на длинные текстовые запросы, насыщенные макеты и изображения с мелкими надписями. Модель поддерживает большие промпты и особенно интересна для случаев, где генератору приходится одновременно понимать содержание сцены, оформление и текстовые элементы.
В нашей проверке Qwen Image 3.0 набрала 8,2 балла. Она достаточно последовательно выполняет формальные условия, но по фотореализму людей, физике материалов и глубине сложного концепт-арта пока уступает лидерам рейтинга.
Упаковка и надпись: условия выполнены, синтетика заметна в деталях

Оценка — 8,8/10. Qwen правильно воспроизвела текст на этикетке и сохранила основные элементы предметной сцены. Это уже хороший показатель для генерации упаковки, где одна неверная буква способна сделать весь результат бесполезным.
Слабее выглядят стекло и вода. Форма флакона слегка деформирована, а всплеск кажется искусственным. Дополнительный признак генерации — чрезмерная локальная резкость: отдельные детали выглядят слишком подчеркнутыми по сравнению с тем, как их передала бы обычная рекламная камера.
Фотореализм человека: корректно по заданию, слабее по ощущению фотографии

Оценка — 7,9/10. Qwen выполнила большую часть условий: в сцене есть женщина, мокрая улица, городское окружение, нужная цветовая гамма и движение. Формально картинка близка к промпту.
Но именно реализм человека отделяет ее от Seedream 5.0 Pro и GPT Image 2. Лицо выглядит более пластиковым, шаг — механическим, а фон уступает по естественности мелких деталей. Изображение не разваливается, однако происхождение из генератора читается быстрее. И обратите внимание, что по умолчанию девушка - азиатка.
Сказочный город: правильные элементы, недостаточный масштаб

Оценка — 7,8/10. Qwen хорошо поняла основные сущности промпта: дерево, водопады, облака, каньон и архитектуру. Но гигантский эльфийский мегаполис уменьшился до сравнительно компактного сказочного замка.
На ближайшем мосту появилось четыре человека вместо заданных трех, часть архитектуры упростилась, а пространство стало менее глубоким. Это хороший пример того, как модель может отметить почти все пункты технического задания, но не до конца передать главный визуальный смысл — в данном случае ощущение колоссального масштаба.
Qwen Image 3.0 интересна для генерации постеров, макетов, изображений с большим количеством текста и длинных промптов. Для максимально реалистичных людей или сложных кинематографических миров результаты нашего теста пока говорят в пользу GPT Image 2, Nano Banana 2 и Seedream 5.0 Pro.
Перейти к нейросети Qwen Image 3.0
Дополнительный тест Midjourney: помогает ли специальный промпт
После основного сравнения у меня возникло логичное предположение: возможно, Midjourney проиграла не столько из-за качества самой модели, сколько потому, что ей хуже подходит обычный подробный промпт на русском языке. Поэтому я повторил тест с фотографией Санкт-Петербурга, но переписал запрос специально под Midjourney — на английском, с фотографической терминологией и параметрами --ar 16:9, --raw, --s 25, --chaos 0, --q 2 и отдельными отрицательными условиями.

Результат действительно стал немного лучше. Кадр выглядит естественнее предыдущего: удачнее свет, убедительнее мокрый асфальт, спокойнее обработка, а героиня меньше напоминает модель с постановочной фотосессии. Но характерные проблемы Midjourney никуда не исчезли. Фигура все еще выглядит немного выстроенной специально для камеры, в ногах и шаге есть странность, а люди на заднем плане при увеличении будто написаны кистью и слабо похожи на настоящих прохожих. Это даже напомнило мои первые тесты Midjourney несколько лет назад, когда узнаваемый человеческий силуэт среди каши из цветов уже воспринимался как огромный прогресс.
Этот эксперимент я не стал учитывать в итоговом рейтинге. Изучать отдельный синтаксис и подбирать специальные параметры только ради того, чтобы получить фотографию, которую GPT Image 2 или другие современные модели способны сделать по обычному подробному промпту на русском языке, — сомнительный компромисс для большинства пользователей. Но провести такой тест ради объективности стоило: адаптация запроса действительно немного помогает Midjourney, хотя полностью ее слабые места в фотореализме и точном следовании сцене не устраняет.
Как выбрать ИИ для фото и изображений под конкретную задачу

Средний балл полезен, но он скрывает специализацию моделей. Seedream 5.0 Pro, например, проигрывает нескольким конкурентам в общей таблице, хотя именно она создала наиболее реалистичного человека. Поэтому выбирать генератор лучше от конечного результата.
Сложный промпт с множеством обязательных деталей — GPT Image 2. В трех разных заданиях модель лучше остальных удерживала общую структуру запроса.
Универсальная альтернатива для регулярной работы — Nano Banana 2. Ни одного провального теста и высокий результат на совершенно разных типах изображений.
Максимально естественные люди и фотографии — Seedream 5.0 Pro. В нашем городском тесте именно она создала наименее «нейросетевого» человека.
Рекламные макеты и изображения с надписями — GPT Image 2, Nano Banana Pro или Flux 2. Все три уверенно прошли сложный тест с упаковкой.
Концепт-арт со строгой структурой — GPT Image 2 или Nano Banana 2. Они лучше сохранили масштаб и пространственные отношения.
Свободный художественный поиск — Midjourney. Ее интерпретация может значительно отклоняться от задания, но это не всегда недостаток, если нужен неожиданный визуальный ход.
Макеты с большим количеством текста — Qwen Image 3.0 и семейство Nano Banana. Эти модели особенно интересны там, где картинка одновременно должна выполнять информационную функцию.
Как составить промпт для генерации реалистичного изображения
Тест показал еще одну закономерность: современные нейросети уже способны выполнить очень длинное техническое задание, но хороший результат сильнее зависит от структуры запроса. Фразы вроде «сделай красивое реалистичное фото» оставляют модели слишком много решений.
Для фотографии удобнее описывать запрос в следующем порядке:
Главный объект. Кто или что находится в кадре, внешность, одежда, материал, форма.
Действие. Не просто «женщина на улице», а «быстро переходит мокрую улицу и смотрит немного в сторону».
Окружение. Архитектура, транспорт, люди, предметы, поверхность, погода.
Свет. Направление, время суток, температура света, отражения и тени.
Камера. Угол съемки, фокусное расстояние, глубина резкости, характер движения.
Физические ограничения. Правдоподобные руки, стекло, отражения, соединения объектов, перспектива.
Что нельзя добавлять. Лишние надписи, логотипы, рамки, дополнительные предметы.
Формат. Например, горизонтальное изображение 16:9.
Для коммерческой генерации полезно отдельно написать точный текст, который должен попасть на изображение, и запретить любые дополнительные символы. Для сложного арта стоит явно перечислить передний, средний и дальний планы: это снижает вероятность получить красивую, но плоскую композицию.
Как пользоваться нейросетями для изображений в России
Каждую нейросеть я тестировал в агрегаторе нейросетей Study AI. Платформа объединяет генераторы изображений в одном аккаунте, работает напрямую из России без VPN, использует русскоязычный интерфейс и поддерживает оплату российскими картами. Это удобно именно для сравнения: один и тот же промпт можно последовательно отправить нескольким моделям и выбрать лучший вариант, не оформляя отдельную подписку на каждый зарубежный сервис.
Практически я бы не пытался заранее угадать идеальную модель для важного рекламного изображения. Сначала запускаю один хорошо проработанный промпт в двух-трех сильных генераторах, сравниваю композицию и ошибки, а затем продолжаю редактировать лучший результат. На сложной задаче дополнительные две генерации обычно полезнее, чем десять попыток исправить изначально неудачную сцену в неподходящей модели.
Какая нейросеть для генерации фото и картинок лучшая
По результатам трех разных тестов лучшим ИИ для генерации изображений оказался GPT Image 2 с итоговыми 9,5 балла. Его главное преимущество не в том, что каждый кадр обязательно самый красивый, а в стабильности: модель точно выполняет длинные инструкции, уверенно пишет текст, понимает сложные композиции и одинаково хорошо работает с рекламой, фотографиями и концепт-артом.
Nano Banana 2 заняла второе место и выглядит наиболее универсальной альтернативой. Seedream 5.0 Pro стоит держать отдельно для задач, где критичен натуральный фотореализм. Nano Banana Pro и Flux 2 сильны в коммерческой предметной генерации, Qwen Image 3.0 интересна для текстовых макетов, а Midjourney остается инструментом прежде всего для ситуаций, где художественная выразительность важнее буквального выполнения технического задания.
Главный вывод сравнения генераторов изображений простой: в 2026 году уже недостаточно оценивать нейросеть по одной красивой картинке. На реальной задаче важнее, умеет ли она сохранить все условия промпта, физику сцены, людей, текст и композицию одновременно. Именно по этому критерию разница между сильными моделями становится особенно заметной.


