Я собрал короткий мультфильм «Бюро потерянных минут» из шести сцен и проверил, насколько современные ИИ для анимации умеют сохранять одного персонажа, работать с раскадровкой и строить связную историю по референсам. Самый очевидный способ — загрузить всё сразу и попросить сделать весь мультфильм одним промптом — оказался не лучшим: сцены сжались, а часть инструкций потерялась. После деления истории на два ролика по три сцены результат стал заметно цельнее.
В статье покажу весь процесс: создание персонажа и стартового кадра в GPT Image 2.5, раскадровку, подготовку референсов, видеопромпты и сборку сцен. Затем сравню 10 нейросетей для создания мультфильмов — Gemini Omni Flash 1.1, MiniMax H3, Kling 3.0, Seedance 2.0 Pro, Wan 3.0 и другие — и отдельно покажу удачные и неудачные генерации, чтобы было понятно, какой ИИ лучше использовать на разных этапах.
Лучшие ИИ для генерации мультфильмов
Gemini Omni Flash 1.1 — самый сбалансированный вариант для генерации сцен, работы с изображениями и последующей правки готового видео.
MiniMax H3 — недорогая нейросеть для генерации анимации по референсам; хорошо подходит для многочисленных черновых попыток.
Kling 3.0 — сильный вариант для персонажной анимации и сцен, где нужно точно направлять движение.
Seedance 2.0 Pro — лучший результат в моём тесте по общей цельности и ощущению настоящего мультфильма, но и один из самых дорогих вариантов.
Wan 3.0 — интересен длинными сценами: позволяет собрать больше действия одним проходом и обходится дешевле Seedance.
Grok Imagine 1.5 — быстрый вариант для создания анимации из картинки и коротких самостоятельных сцен.
Как сделать мультик с помощью ИИ: мой пошаговый процесс

Шаг 1. Начните не с видео, а с короткой истории
Первая версия сценария должна быть достаточно простой, чтобы нейросеть не тратила силы на постоянное переизобретение мира. Для теста я ограничился одним главным героем, двумя связанными локациями и шестью сценами.
Получился короткий мультфильм «Бюро потерянных минут». Главный герой — уставший ночной архивариус странного учреждения, куда якобы поступают минуты, потерянные людьми в очередях, пробках и бессмысленных совещаниях. Немного абсурда, немного мистики — и никаких привычных мультяшных котиков.
Сюжет я сразу разбил на шесть эпизодов:
Последний посетитель ушёл. Архивариус остаётся один в ночном кабинете среди старых часов и папок. На столе стоит давно остывший кофе.
Квитанция сбегает. Узкая бумажная лента сама выползает из кассового аппарата, спускается со стола и исчезает под дверью.
Хранилище минут. Герой идёт следом и обнаруживает огромное помещение со стеклянными сосудами, внутри которых словно законсервированы маленькие кусочки времени.
Время останавливается. Один сосуд падает с полки. Вместе с ним застывают листы бумаги, капля кофе и пыль в луче света.
Архивариус спасает минуту. Он успевает поймать сосуд почти у самого пола.
Награда. Герой возвращается в кабинет и обнаруживает, что его давно холодный кофе снова горячий.
Такой сюжет достаточно разнообразен визуально, но не заставляет модель каждые пять секунд создавать нового персонажа, новую эпоху и новый мир. Для первой генерации мультика это гораздо практичнее.
Шаг 2. Сгенерируйте лист персонажа в GPT Image 2.5

Первым делом я создал героя в GPT Image 2.5. Для этой задачи модель особенно удобна: можно получить персонажа сразу в нескольких ракурсах, а затем использовать тот же исходник при создании последующих сцен.
Не начинайте с красивого постера. Нужен именно технический референс: анфас, профиль, три четверти, полный рост. Чем меньше неопределённости останется для видеомодели, тем лучше она удержит героя позже.
Промпт для листа персонажа:
Создай лист референсов одного персонажа для серьёзного авторского рисованного мультфильма. Мужчина около 45 лет, худощавый, немного сутулый, узкое уставшее лицо, короткие тёмные волосы с сединой на висках, длинный тонкий нос, спокойное слегка ироничное выражение. На нём тёмно-синяя рабочая куртка архивариуса, бордовая рубашка без галстука, графитовые брюки, старые коричневые ботинки и механические часы на кожаном ремешке. Один и тот же человек показан анфас, в профиль, со спины и в ракурсе три четверти. Европейская рисованная анимация, матовая гуашь, сухая кисть, лёгкая бумажная фактура, ограниченная палитра: графитовый, тёмно-синий, кремовый, бордовый. Реалистичные взрослые пропорции, никакой детской мультяшности, больших глаз и глянцевого 3D. Светлый нейтральный фон, без текста.
GPT Image 2.5 прекрасно понимает русский язык, переводить промпт не нужно. После генерации я не переходил сразу к видео. Сначала нужен был ещё один визуальный якорь.
Шаг 3. Сделайте стартовую сцену и зафиксируйте стиль

Отдельно я сгенерировал полноценный стартовый кадр. Он нужен не только для первой сцены: это образец освещения, палитры, детализации помещения и вообще того, как должен выглядеть весь мультфильм.
Промпт:
Используй приложенный лист персонажа и строго сохрани его внешность, возраст, одежду и пропорции. Ночная диспетчерская необычного муниципального архива потерянного времени. Мужчина сидит за старым деревянным столом. Перед ним бумаги, чашка холодного кофе и старый кассовый аппарат. Позади высокие металлические шкафы с папками и несколько механических часов. За окном идёт дождь. Тёплый свет зелёной настольной лампы контрастирует с холодными сине-серыми тенями. Серьёзная европейская 2D-анимация, матовая гуашь, сухая кисть, бумажная фактура, сдержанная взрослая эстетика с лёгким абсурдом. Средний широкий план, кинематографичная композиция, без текста.
Этот кадр затем можно прикладывать вместе с листом персонажа при создании раскадровки. Лист отвечает на вопрос «кто герой», стартовая сцена — «в каком мире он существует».
Шаг 4. Создайте шесть изображений для раскадровки
Следующий этап — шесть отдельных изображений. Здесь я уже не искал дизайн: персонаж и стиль были утверждены. Задача GPT Image 2.5 — поставить того же героя в нужные точки истории.
При генерации каждого кадра полезно прикладывать лист персонажа и стартовую сцену. Если предыдущая сцена особенно удачна, её тоже можно использовать как дополнительный ориентир.
Сцена 1. Ночной кабинет

Используй приложенные референсы и строго сохрани героя, одежду и художественный стиль. Ночной архивариус сидит один за деревянным столом. На столе холодная чашка кофе, бумаги и старый кассовый аппарат. На стенах несколько механических часов. Герой устало смотрит на последнюю бумажную квитанцию. Тёплый свет настольной лампы контрастирует с холодным тёмным кабинетом. Средний широкий план, матовая рисованная гуашь, бумажная фактура, без текста.
Сцена 2. Сбежавшая квитанция

Тот же архивариус, тот же кабинет, одежда и визуальный стиль. Низкий ракурс около пола. Длинная бумажная лента сползает со стола, изгибается по полу и исчезает под приоткрытой дверью архива. Герой в глубине кадра удивлённо встаёт со стула. Бумага остаётся обычной бумажной лентой — без лица, глаз, рук и других антропоморфных деталей.
Сцена 3. Хранилище потерянного времени

Тот же архивариус входит в огромное тёмное архивное помещение. Высокие стеллажи уходят почти до потолка. На них стоят сотни стеклянных сосудов разных размеров. Внутри некоторых словно замерли маленькие бытовые моменты: капля дождя, струйка пара, падающий лист бумаги, песок, крошечный источник света. Герой смотрит вверх. Загадочная атмосфера, но без хоррора. Тот же стиль рисованной гуашевой анимации.
Сцена 4. Всё застыло

Тот же архивариус в хранилище. Один небольшой стеклянный сосуд падает с верхней полки. Мир вокруг внезапно останавливается: несколько листов неподвижно висят в воздухе, капля жидкости зависла в полёте, пыль остановилась в луче света. Архивариус продолжает двигаться и резко тянется к падающему сосуду. Динамичная диагональная композиция, без визуального хаоса.
Сцена 5. Пойманная минута

Тот же герой поймал небольшой стеклянный сосуд двумя руками всего в нескольких сантиметрах от пола. Крупный средний план. На лице не героический пафос, а усталое облегчение человека, которому очень не хотелось заполнять акт о порче имущества. Вокруг всё ещё висят неподвижные листы бумаги. Строго сохранить лицо, одежду и рисованный стиль.
Сцена 6. Горячий кофе

Тот же архивариус снова сидит за исходным столом. Композиция перекликается с первой сценой. Теперь от старой чашки кофе идёт тёплый пар. Герой смотрит сначала на чашку, затем на настенные часы и едва заметно улыбается. За окном дождь, кабинет снова живёт обычной жизнью. Спокойный комедийный финал, без текста.
В итоге у меня получился лист персонажа, стартовая сцена и шесть готовых кадров. Казалось бы, дальше остаётся загрузить всё это в видеомодель и попросить сразу снять фильм. Именно так я сначала и поступил.
Шаг 5. Почему я не советую генерировать все шесть сцен одним промптом
Первый вариант был максимально прямолинейным: я загрузил все референсы, описал шесть сцен одним большим промптом и попросил модель сделать единый ролик. Формально подход выглядит логично и нейросеть с генерацией справилась на твердую 4. Но не идеально.
Слишком много вещей происходило одновременно: модель должна была удерживать героя и художественный стиль, понять шесть разных композиций, распределить действия по времени и ещё построить переходы. Чем длиннее становилась инструкция, тем меньше контроля оставалось над каждой конкретной сценой. Это видно по мультику - получилось немного сжато.
Это не значит, что многоэпизодная генерация бесполезна. Напротив, современные видеомодели уже хорошо работают с несколькими планами. Просто шесть заметно разных эпизодов для одного прохода в моём случае оказалось слишком амбициозно.
Я разделил мультфильм пополам: сцены 1–3 в первый ролик и сцены 4–6 во второй. И вот здесь результат оказался совсем другим — получился вполне приятный короткий мультфильм, который уже хочется смотреть, а не просто разбирать как демонстрацию нейросети.
Шаг 6. Генерируйте по три сцены за один проход
Схема 3+3 показалась мне оптимальной. Внутри одного фрагмента модель ещё может построить небольшую драматургию и переходы, но ей не приходится помнить сразу весь фильм.
Для первого фрагмента используйте:
лист персонажа;
стартовую сцену;
изображения сцен 1, 2 и 3.
Для второго:
тот же лист персонажа;
при возможности — финальный кадр первого готового ролика или изображение сцены 3 как мостик между частями;
изображения сцен 4, 5 и 6.
Если интерфейс позволяет подписывать или нумеровать референсы, обязательно делайте это. Формулировка «Image 1 — персонаж, Image 2 — стартовая сцена, Image 3 — сцена с квитанцией» гораздо понятнее, чем просьба самостоятельно разобраться в пяти загруженных картинках. Но я просто загружал в нужном порядке - ИИ прекрасно разобрался.
Небольшое уточнение, промпты и пишу на русском, чтобы вам было понятнее, но в ИИ лучше вставлять на английском (переведите в любом переводчике). Хотя все современные модели заявляют, что они могут и сами перевести - так надежнее.
Промпт 1: сцены 1–3
Создай связный короткий мультфильм из трёх последовательных сцен. Используй приложенные изображения как точные визуальные референсы. Строго сохраняй внешность главного архивариуса, его возраст, телосложение, одежду, палитру и стиль рисованной гуашевой анимации.
СЦЕНА 1. Архивариус один сидит за столом в ночном кабинете. Несколько секунд он устало рассматривает квитанцию, медленно моргает и переводит взгляд на часы. Затем замечает, что длинная бумажная лента начинает сама выползать из кассового аппарата.
СЦЕНА 2. Камера мягко опускается ближе к полу. Бумажная лента сползает со стола, ускоряется и извивается по полу в сторону двери. Она остаётся обычной бумагой, без глаз, лица и конечностей. Архивариус удивлённо встаёт и идёт следом.
СЦЕНА 3. Плавный переход в огромное тёмное хранилище. Архивариус входит внутрь и медленно движется между высокими стеллажами со стеклянными сосудами. Камера немного поднимается вверх, раскрывая масштаб помещения. Внутри отдельных сосудов едва заметно существуют замершие фрагменты времени: капля воды, пар, лист бумаги, свет.
Переходы между сценами естественные и кинематографичные. Не менять лицо героя, одежду и художественный стиль. Не добавлять новых персонажей. Сдержанная актёрская игра, никакой карикатурной мимики. Без диалогов.
Результат:
Промпт 2: сцены 4–6
Используй загруженные изображения как основные и точные визуальные референсы для персонажа, локации, композиции и художественного стиля. Не опирайся на память о предыдущих генерациях, если они не переданы среди входных материалов. Главный герой должен строго соответствовать загруженным референсам: то же лицо, возраст, телосложение, причёска, одежда, пропорции, пластика движений и общий характер. Сохрани ту же палитру, матовую гуашевую фактуру, бумажную текстуру, освещение и общую эстетику серьёзного авторского рисованного мультфильма.
Создай связный короткий видеоролик из трёх последовательных сцен с плавными, понятными и кинематографичными переходами. Важно, чтобы вторая часть ощущалась естественным продолжением истории: зритель должен ясно понять, как герой подошёл к стеллажу, почему началось падение сосуда и как затем происходит возвращение в кабинет.
СЦЕНА 1.
Хранилище потерянного времени. Архивариус уже находится в огромном тёмном архивном помещении среди высоких стеллажей со стеклянными сосудами. Это логическое продолжение предыдущей части истории, поэтому начало сцены должно спокойно и ясно показать, что герой осматривает хранилище и подходит ближе к одному из стеллажей. Он медленно идёт вдоль полок, внимательно смотрит на сосуды, слегка поднимает голову и останавливается. Камера плавно сопровождает его сбоку или немного сзади, затем мягко смещается так, чтобы зритель увидел верхнюю часть стеллажа. Внутри некоторых сосудов едва заметно присутствуют маленькие замершие фрагменты времени: капля дождя, струйка пара, лист бумаги, крошечный источник света. Атмосфера загадочная, сдержанная, немного абсурдная, но без хоррора. Затем один стеклянный сосуд на верхней полке начинает опасно смещаться, слегка качается и внезапно срывается вниз. Очень важно показать именно момент начала падения и реакцию героя, чтобы переход к следующей сцене был логичным и визуально понятным.
СЦЕНА 2.
Архивариус замечает падающий сосуд и быстро делает шаг вперёд, чтобы его поймать. В этот момент окружающий мир постепенно замирает: листы бумаги останавливаются в воздухе, капля жидкости зависает в полёте, пыль перестаёт двигаться в луче света. Только сам герой и падающий сосуд продолжают движение. Архивариус неловко, но правдоподобно тянется к сосуду двумя руками. Его движение должно выглядеть немного поспешным и живым, но не комичным и не карикатурным. Камера слегка приближается, подчёркивая напряжение момента, но не делает резких скачков и не ломает композицию. Здесь особенно важно сохранить точный дизайн персонажа, его одежду, черты лица и общий стиль сцены. Не добавляй новых предметов, персонажей или лишних эффектов. Остановка времени должна считываться ясно и выразительно.
СЦЕНА 3.
Архивариус ловит сосуд двумя руками почти у самого пола. На короткий миг всё вокруг полностью замирает. Затем он выдыхает с усталым облегчением, осторожно стабилизирует сосуд и после этого время снова запускается: листы бумаги продолжают падать, пыль движется, пространство оживает. Переход должен быть плавным и естественным. После этого следует мягкий переход обратно в ночной кабинет. Архивариус снова сидит за своим столом в той же одежде, в той же палитре и в той же визуальной эстетике. Он замечает, что от давно остывшей чашки кофе неожиданно идёт тёплый пар. Герой осторожно касается чашки, делает маленький глоток, затем переводит взгляд на часы и едва заметно улыбается. Камера медленно отъезжает назад. За окном продолжается дождь. Финал должен быть спокойным, слегка ироничным, с мягким комедийным оттенком, но без чрезмерной мимики, без пафоса и без лишней драматизации.
Во всём ролике:
— строго сохраняй одного и того же героя без изменений внешности;
— не меняй одежду, лицо, пропорции, помещение и художественную технику;
— сохраняй единый взрослый рисованный стиль, матовую гуашь, бумажную фактуру и сдержанную палитру;
— движения должны быть физически понятными, последовательными и логичными;
— переходы между сценами должны быть плавными и естественными;
— не добавляй новых персонажей, лишние предметы, случайные события или неописанные действия;
— не превращай бумагу, сосуды или другие объекты в антропоморфных существ;
— не добавляй текст в кадре;
— без диалогов;
— настроение: серьёзная авторская анимация с лёгким абсурдом и мягким комедийным финалом.
Результат:
Какие референсы загружать в разных режимах
У видеонейросетей сейчас нет единого стандарта работы с исходниками. Одни принимают целый набор изображений и сами используют их как reference-to-video, другие предлагают специальный режим первого и последнего кадра.
Если доступны обычные изображения-референсы, для нашего сценария удобнее загрузить героя плюс три кадра нужной части мультфильма. Модель получает достаточно информации о персонаже и одновременно видит последовательность сцен.
Если используется First Frame / Last Frame, не пытайтесь одновременно превратить каждую картинку раскадровки в жёсткую контрольную точку. Для первого ролика можно поставить сцену 1 начальным кадром, сцену 3 — конечным, а сцену 2 подробно описать внутри промпта. Для второго соответственно использовать сцены 4 и 6, а сцену 5 оставить промежуточным событием.
MiniMax H3, например, разделяет first/last-frame и omni-reference сценарии: в одном случае задаются опорные изображения начала и конца, в другом можно использовать несколько изображений, видео и аудиоматериалов как общий контекст. У Wan 3.0 тоже стоит заранее выбрать подход: reference-материалы и режим first/last frame — разные способы управления генерацией.
В Seedance 2.0 особенно удобно работать именно через набор референсов: модель принимает изображения, видео и звук, поэтому можно показать героя, окружение и несколько необходимых визуальных состояний без попытки описать всё словами.
Шаг 7. Сначала соберите черновик, потом переделывайте слабые места
После двух генераций я бы не советовал сразу переделывать понравившийся ролик только потому, что в одной секунде движение можно было бы сделать чуть аккуратнее. Сначала соедините обе части и посмотрите историю целиком.
На монтаже становятся видны совсем другие вещи: где сцена затянута, где два соседних плана слишком похожи, где переход съедает шутку, а где хочется оставить лишнюю секунду тишины.
Если модель поддерживает редактирование готового видео, удачный фрагмент можно поправить локально. Особенно удобен здесь Gemini Omni Flash 1.1: модель позволяет продолжить работу с уже созданным роликом и попросить изменить конкретную деталь.
«Сделай движение бумажной ленты медленнее. Всё остальное оставь без изменений».
«Сохрани персонажа и фон. Убери лишнее движение камеры».
«Сделай выражение лица героя менее удивлённым».
«Не меняй сцену. Уменьши интенсивность дождя за окном».
Короткая правка здесь обычно полезнее нового огромного промпта.
Как сохранить одного персонажа во всех сценах
После теста я бы выделил несколько правил, которые действительно имеют значение.
Сначала сделайте мастер-референс. Не ищите внешность героя заново для каждой сцены.
Покажите несколько ракурсов. Одного портрета мало, если дальше герой появляется в полный рост и поворачивается спиной.
Зафиксируйте одежду. «Синяя куртка», «тёмный пиджак» и «графитовая форма» для модели могут оказаться тремя разными костюмами.
Создайте стартовую сцену. Она задаёт мир: свет, помещение, фактуру, цвет.
Делайте раскадровку картинками. Важную композицию проще показать, чем описывать абзацем.
Не перегружайте одну генерацию. В моём тесте шесть сцен одним проходом оказались заметно хуже, чем два ролика по три.
Повторно используйте удачные результаты. Финальный кадр первой части может стать референсом второй.
Как писать промпт для генерации анимации из картинки
Для GPT Image 2.5 я подробно описывал героя, интерьер, материалы и цвет. В видеопромпте всё наоборот: если эта информация уже есть на референсе, лучше потратить текст на движение.
Рабочая формула выглядит так:
кто движется → что делает → что происходит вокруг → как движется камера → какой темп → что запрещено менять.
Например:
Архивариус медленно поворачивает голову вправо и делает один осторожный шаг. Край куртки слегка двигается, бумажная лента скользит по полу. Камера плавно следует сбоку на той же высоте. Спокойный темп. Сохрани исходное лицо, одежду, пропорции и рисованную фактуру. Не добавляй новых персонажей и не меняй фон.
Чем яснее физическое действие, тем лучше. «Сделай сцену красивой, динамичной, эпичной и кинематографичной» сообщает модели гораздо меньше, чем «камера медленно приближается, герой поднимает чашку и переводит взгляд вправо».
10 нейросетей для создания мультфильмов и анимации

1. Gemini Omni Flash 1.1 — самый сбалансированный вариант
Gemini Omni Flash 1.1 я бы сейчас назвал наиболее рациональным вариантом для первого полноценного ИИ-мультфильма. Модель умеет создавать видео из текста и изображений, работать с первым и последним кадром, а главное — редактировать уже полученный ролик следующими текстовыми командами.
Последнее для практической работы важнее очередного красивого демо. Если из десяти секунд вам нравятся девять, нет желания пересобирать всё с нуля только из-за неправильного движения руки. Можно попросить сохранить остальную сцену и изменить конкретный элемент.
Генерация с нуля и по изображению.
Переход между первым и последним кадром.
Последовательное редактирование готового видео.
Удобный баланс контроля, качества и стоимости.
По итогам моих тестов именно Gemini Omni Flash 1.1 выглядит самым оптимальным вариантом по совокупности факторов. Это не самый дешёвый и не самый впечатляющий генератор в абсолюте, зато здесь проще получать много рабочих попыток и доводить удачные сцены.
2. MiniMax H3 — дешёвый способ много экспериментировать
MiniMax H3 хорошо подходит к нашему процессу уже архитектурно. У модели есть режим с первым и последним кадром и отдельный omni-reference сценарий, где контекст можно собирать из изображений, видео и аудио.
Вторая причина проще — цена. В моих генерациях H3 оказался самым дешёвым из основных вариантов. Для черновой работы ощущается почти как бесплатный: можно делать несколько попыток, менять движения и не переживать, что каждый неудачный дубль съедает заметную часть бюджета.
До нескольких изображений в reference-сценарии.
Можно использовать видео и аудио как ориентиры.
Поддерживаются первый и последний кадр.
Хороший вариант для многочисленных пробных генераций.
Я бы использовал MiniMax H3 для чернового поиска движения и композиции, а дорогую модель подключал уже после того, как сцена понятна.
3. Kling 3.0 — когда движение важнее автоматизации
Kling 3.0 остаётся сильным вариантом для персонажных сцен. Модель работает с текстом, изображениями и другими референсами, а актуальное поколение рассчитано не только на один красивый план, но и на более связную работу со сценой.
Для нашего мультфильма я бы в первую очередь отдал Kling эпизод с падающим сосудом. Там важна последовательность: герой видит объект, делает шаг, наклоняется и ловит его. Подобные сцены выигрывают от чётких опорных состояний и аккуратного описания движения.
Максимальная длина одной генерации в Kling 3.0 достигает 15 секунд, поэтому схема из двух частей по три сцены здесь выглядит вполне естественно.
4. Seedance 2.0 Pro — самый красивый результат моего теста
Seedance 2.0 Pro оказался тем случаем, когда после генерации я не стал первым делом искать ошибки. Результат мне действительно очень понравился — просто сказка. Мультфильм воспринимался цельно, движение выглядело выразительно, а переходы между сценами не разрушали общую атмосферу.
Для такого процесса Seedance подходит отлично: модель понимает одновременно текст, изображения, видео и аудио, а несколько референсов можно использовать в одной генерации. Именно поэтому наш набор «персонаж + сцены раскадровки + инструкция» здесь уместен.
Есть один вполне практический минус — стоимость. При нескольких версиях каждой сцены бюджет растёт быстро. Если делать один короткий ролик ради красивого результата — оправданно. Если планируется сериал из десятков сцен, я бы сначала считал расходы.
5. Wan 3.0 — длиннее и дешевле
Wan 3.0 решает немного другую проблему: позволяет генерировать видеосцены длительностью до 30 секунд. То есть три коротких эпизода необязательно жёстко ужимать в десятисекундный ролик — появляется пространство для пауз и спокойной камеры.
Модель принимает текст, изображения, видео и аудио, умеет работать с first/last frame и отдельным reference-режимом. Для длинного ИИ-мультфильма это одна из самых интересных возможностей сейчас.
В моих тестах Wan оказался дешевле Seedance, поэтому для проектов с большим количеством материала выглядит практичнее. Качество конкретной сцены всё равно нужно проверять, но возможность получать до 30 секунд за один проход меняет сам подход к монтажу.
6. Grok Imagine 1.5 — быстро оживить готовую иллюстрацию
Grok Imagine 1.5 особенно удобен, когда хорошая картинка уже существует. Загружаете исходный кадр и описываете движение, камеру и атмосферу — модель превращает статичную композицию в видео.
Поэтому Grok логично подключать не ко всему мультфильму сразу, а к отдельным эпизодам: реакция героя, короткая проходка, движение камеры, оживление атмосферного общего плана.
Это полезный дополнительный инструмент, когда хочется быстро попробовать несколько вариантов анимации одной и той же картинки.
7. Invideo AI — когда не хочется собирать производство вручную
Invideo AI идёт по другому пути. Вместо ручной работы с каждой сценой сервис может получить идею, написать сценарий, подобрать или создать визуалы, добавить голос, музыку и субтитры, а затем собрать ролик целиком.
Это удобно для объясняющих видео, образовательной анимации и контента, где скорость важнее полного контроля над каждым кадром. Готовый ролик можно дальше редактировать текстовыми командами.
Для «Бюро потерянных минут» я всё же предпочёл бы ручную раскадровку: слишком много атмосферы завязано на одинаковом герое и визуальной композиции. А вот для мультяшного ролика «объясняем инфляцию за минуту» автоматизация Invideo выглядит вполне логично.
8. Dreamina — картинка и анимация в одном сервисе
Dreamina подходит тем, кто не хочет постоянно переносить файлы между разными генераторами. Внутри можно создать изображение персонажа, а затем сразу перейти к Image-to-Video.
Сейчас Dreamina использует в том числе более новое поколение Seedance 2.5 и позволяет работать с текстом, изображениями и другими визуальными референсами. Для новичка это комфортная среда: персонаж, ключевой кадр и анимация находятся рядом.
Главное преимущество здесь скорее не отдельная модель, а цельность процесса.
9. Krikey AI — для управляемых 3D-персонажей
Krikey AI пригодится, если под «мультфильмом» имеется в виду не генеративная живопись, а постоянный 3D-герой. Сервис специализируется на аватарах, анимации персонажей и переносе движений.
Такой подход хорош для обучающих ведущих, игровых персонажей и серии роликов с одним героем. Здесь меньше визуальной случайности: аватар уже существует как отдельный объект, а вы управляете его движениями и сценой.
Для авторского рисованного мультфильма возможностей стилизации меньше, зато для повторяемого 3D-персонажа это может оказаться преимуществом.
10. LensGo AI — если сначала проще снять движение самому
LensGo AI полезен для обратного процесса. Вместо того чтобы долго объяснять нейросети сложное движение словами, можно сначала снять обычное видео, а затем превратить его в стилизованную или мультяшную сцену.
Такой Video-to-Video подход особенно хорош для танца, жестов, проходки и взаимодействия нескольких людей. Камера и пластика уже определены исходником — нейросети остаётся изменить визуальный слой.
Это не всегда лучший путь для полностью вымышленного мира, зато проблему сложной анимации персонажа он иногда решает неожиданно просто.
Что не получилось: три неудачные генерации
Не все попытки вошли в финальный мультфильм. Я оставил три неудачных варианта: они хорошо показывают, что высокая детализация картинки ещё не означает точного следования сценарию, а слишком сложный промпт способен запутать даже сильную видеомодель.
Veo 3.1 — весь мультфильм одним промптом
В первой попытке я загрузил референсы и попросил Veo 3.1 сделать сразу весь мультфильм. За последний год я прогнал через Veo сотни 2 разных промптов и уже сроднился с ним но видимо его время ушло. Модель частично проигнорировала исходные изображения и часть промпта: история получилась скомканной, движения местами нелогичными, зато сами переходы между сценами сделаны довольно качественно.
MiniMax H3 — сцены 1–3
Первая попытка разделить мультфильм на части уже выглядела гораздо лучше: качество изображения отличное, персонаж и общая атмосфера сохранились. Но у бумажной ленты появился небольшой визуальный глюк, а последний кадр оказался заметно затянут — неплохой результат, который всё же хотелось доработать.
Вторая часть — сцены 4–6
Здесь нейросеть перепутала порядок отдельных событий и довольно свободно интерпретировала движения персонажа. Эффект остановки времени фактически исчез, а падение колбы герой зачем-то неловко изображает сам — выглядит забавно, но это совсем не та сцена, которую я описывал в промпте.
Что показал мой тест: какую нейросеть выбрать
После практической генерации я бы не составлял рейтинг только по «красоте одного кадра». Для мультфильма важны сразу качество, цена, длина сцены, работа с референсами и количество попыток, которые вы реально можете себе позволить.
Нейросеть | Мой вывод | Когда выбирать |
|---|---|---|
Gemini Omni Flash 1.1 | Самый сбалансированный вариант | Основной рабочий инструмент для большинства мультфильмов |
MiniMax H3 | Самый дешёвый из протестированных | Черновики, многочисленные попытки, эксперименты |
Kling 3.0 | Сильная персонажная анимация | Сложное движение и опорные кадры |
Seedance 2.0 Pro | Лучший результат, но дорого | Финальные сцены, где качество важнее бюджета |
Wan 3.0 | Длинные ролики и разумнее по цене | Более продолжительные сцены и большие проекты |
Grok Imagine 1.5 | Быстрое оживление изображения | Короткие самостоятельные планы |
Seedance 2.0 Pro дал мне самый приятный результат визуально. Если нужен один красивый короткий мультфильм и цена не критична, я бы точно его попробовал.
Wan 3.0 интереснее для объёма: он генерирует более длинные сцены и при этом в моём случае обходился дешевле Seedance.
Gemini Omni Flash 1.1 я оставил бы основным вариантом. Хорошее качество, нормальная управляемость, разные способы работы с исходниками и возможность править готовый ролик делают его наиболее универсальным.
А MiniMax H3 — находка для экспериментов. Он получился настолько дешёвым относительно остальных, что на нём удобно без особых сожалений проверять промпты, движения и структуру сцены, а уже удачную идею при желании повторять в более дорогой модели.
Можно ли бесплатно создать мультфильм нейросетью
Бесплатная генерация мультика возможна скорее как тест, чем как полноценное производство. Некоторые сервисы дают стартовые кредиты или бесплатные попытки, но видеогенерация остаётся ресурсоёмкой.
Зато расходы легко сократить правильным процессом. Не ищите героя внутри видеогенератора. Сначала подготовьте персонажа и раскадровку в GPT Image 2.5, а дорогие видео запускайте только после того, как композиция уже утверждена.
Для черновых прогонов я бы также использовал MiniMax H3. В моём тесте именно он позволял экспериментировать почти без ощущения, что каждая попытка стоит слишком дорого.
Как создать мультфильм по фото
Создание анимации из фото работает по той же схеме. Вместо нарисованного листа персонажа исходником становится фотография человека, предмета или места.
Сначала желательно сделать несколько согласованных референсов: портрет, полный рост, профиль. После этого можно подготовить ключевые сцены в GPT Image 2.5, сохраняя внешность человека, а затем оживить изображения через Image-to-Video.
Если важна конкретная пластика, есть ещё один путь: сначала записать движение обычной камерой, а затем использовать видеореференс или Video-to-Video. Для танцев и сложной жестикуляции это порой проще, чем описывать каждое движение словами.
Как создать мультфильм для детей с помощью ИИ
Сам производственный процесс не меняется: персонажи, визуальный стиль, раскадровка, ключевые кадры, генерация анимации и монтаж. Отличается сценарий.
Для детского мультфильма лучше делать одно понятное действие в сцене и хорошо читаемый силуэт героя. Не обязательно копировать готового персонажа или стиль конкретной студии. Проще описать нужные свойства: мягкая книжная акварель, округлые формы, пластилиновая фактура, яркая 2D-анимация или объёмный семейный мультфильм.
Так у проекта появляется собственный визуальный язык, а согласованность между эпизодами поддерживать легче.
Как сейчас лучше делать мультфильм с помощью ИИ

После теста я бы точно не советовал начинать создание мультфильма с одной огромной команды в видеогенераторе. Намного надёжнее сначала придумать короткую историю, сделать в GPT Image 2.5 лист персонажа, стартовую сцену и полную раскадровку.
После этого не обязательно генерировать каждый кадр отдельным роликом. В моём случае лучший баланс получился при делении шести сцен на два промпта по три сцены. Так модель ещё может сама построить красивые переходы, но не теряется внутри слишком длинной истории.
Если выбирать один ИИ для создания мультфильмов, я бы начал с Gemini Omni Flash 1.1. Если нужно много дешёвых экспериментов — MiniMax H3. Wan 3.0 интересен длинными сценами, а Seedance 2.0 Pro я оставил бы для тех моментов, где хочется получить максимальный визуальный эффект. В моём тесте именно Seedance дал тот редкий результат, после которого не хочется разбирать нейросеть по функциям — хочется просто посмотреть мультфильм ещё раз.

