Анимационная серия без студии анимации: как мы собирали трёх персонажей для Paulaner
Анимационную серию для Paulaner мы собирали нейросетью, и самым долгим этапом было утверждение персонажа, а не рендер. Рисованный ролик с героем без студии анимации сегодня возможен: сцены генерирует модель по листу персонажа и раскадровке, а человек отвечает за характер, сценарий и монтаж. Ниже порядок работы — стиль, лист персонажа, сцена, голос, сборка — и место, где самостоятельный путь упирается в предел.

Почему персонаж занимает дольше, чем рендер
Для Tap Beer и Paulaner мы делали трёх героев, и каждый олицетворяет свой сорт: Стаут Офишл — серьёзный, в смокинге, для тех, кто разбирается; Старик АРА — душевный бородач с баварской историей; Студент IPA — дерзкий и молодой, для тех, кто только открывает крафт. У каждого свой характер, голос, манера подачи и линейка эпизодов.
Сцену нейросеть рендерит за минуты
А вот решить, кто этот герой, что он говорит и чего никогда не скажет, — это круги обсуждений с заказчиком. Смокинг или свитер, борода или усы, шутит или поучает — каждый такой выбор меняет все будущие серии, поэтому его нельзя откладывать «до монтажа».
Отсюда главный совет для тех, кто идёт сам
Сначала утвердите героя на бумаге и в трёх картинках, и только потом открывайте генератор видео. Иначе вы будете переделывать не одну сцену, а всё, что успели собрать.
Стиль: 2D, 3D или стоп-моушен
Первое решение — не сюжет, а стиль, потому что он задаёт и ограничения нейросети, и ощущение от бренда.
Плоская 2D-графика проще всего держится от кадра к кадру
Меньше деталей — меньше расхождений. Подходит для объясняющих роликов, инструкций, персонажа-помощника в сервисе. 3D в духе полнометражных мультфильмов выглядит дороже, но у моделей чаще плывут пропорции лица и материалы: в одной сцене куртка кожаная, в другой — тканевая. Стоп-моушен и пластилин сейчас хорошо смотрятся в ленте, но с ними нейросети работают неровно: фактура то появляется, то пропадает.
Выбирайте по двум вопросам
Где ролик будут смотреть — в ленте с телефона или на экране на мероприятии? И что уже есть у бренда: если фирменный стиль плоский и графичный, 3D-герой будет выглядеть чужим. В Higgsfield стиль выбирается пресетом до генерации, и это удобно: одну и ту же сцену можно сделать в трёх стилях и положить рядом — для заказчика или для себя.
Хотите попробовать по ходу чтения? Инструменты из статьи — в один клик.
Лист персонажа в трёх ракурсах
Лист персонажа — это одна картинка, на которой герой стоит лицом, в три четверти и в профиль, в одной и той же одежде и палитре. В классической анимации так делают всегда; для нейросети это ещё важнее, потому что по этому листу модель будет «узнавать» героя в каждой новой сцене.
Как собрать. Опишите героя текстом: возраст, телосложение, три-четыре приметы (борода, очки, смокинг, кружка в руке), два основных цвета, стиль. Сгенерируйте десять вариантов, выберите один и дальше не меняйте описание ни на слово. Затем по референсу получите остальные ракурсы и эмоции: спокойный, удивлённый, смеётся. Промпт лучше писать на английском; генераторы картинок по референсу есть в SYNTX и в Higgsfield.
Сохраните лист отдельным файлом и заведите текстовый документ с «библией» героя: как говорит, чего не делает, какие фразы повторяет. У персонажей Paulaner характер, голос и манера подачи были прописаны для каждого, и этот документ экономил споры больше, чем любая техника.
Раскадровка и генерация сцен
Эпизод на 15–30 секунд — это четыре–шесть кадров
На каждый кадр в раскадровке одна строка: кто в кадре, что делает, где, куда движется камера. Не пишите «герой рассказывает о продукте»; пишите «Старик сидит за стойкой, поднимает кружку, камера медленно наезжает». Нейросеть исполняет действия, а не смыслы.
Дальше два шага на каждый кадр
Сначала картинка по референсу с листа персонажа — так герой остаётся собой. Потом эта картинка превращается в видео на три–пять секунд: движение камеры и одно действие. Длинные фрагменты не заказывайте: на восьмой секунде у героя может поменяться лицо, и переделывать придётся всё.
Проверяйте каждый кадр по чеклисту
Та же одежда, те же цвета, тот же возраст, руки в порядке, текст в кадре без ошибок. Всё, что не прошло, — перегенерировать сразу, до монтажа. На этом этапе цена ошибки — минуты, после сборки — часы.
Голос и сборка серии
Голос у персонажа один на весь сериал
Выберите его до первой серии, сохраните настройки и не трогайте: зритель узнаёт героя по интонации быстрее, чем по картинке. Реплики озвучиваются из текста; для мультяшной анимации точная синхронизация губ не обязательна, достаточно движения рта в такт, и это заметно упрощает жизнь.
Сборка — любой видеоредактор, в котором вы уже работаете
Кадры друг за другом, голос, музыка тише голоса, субтитры: в ленте смотрят без звука. Одинаковая заставка на две секунды в начале и одинаковая концовка с логотипом — так эпизоды складываются в узнаваемую серию, а не в набор роликов.
Пишите сразу три эпизода, а не один
Первый уходит на притирку: вы поймёте, где герой «плывёт», где реплика длиннее кадра. К третьему у вас будет рабочий шаблон, и следующие серии будут занимать вечер, а не выходные.
Где самостоятельный путь заканчивается
Одного героя для своих соцсетей можно собрать самому: вечер на лист персонажа, вечер на три эпизода. Предел наступает в трёх случаях. Персонажей несколько, и каждый говорит со своей аудиторией — как у Paulaner, где Стаут, Старик и Студент нужны разным людям у одной стойки. Серия должна выходить регулярно месяцами, и на десятом эпизоде герой у вас уже не тот, что на первом. И когда ролики идут в рекламу, где кадр с лишним пальцем стоит бюджета показа.
В пакете 20 роликов без съёмки за 120 000 ₽ персонаж и стиль собираются один раз, а раскадровку мы показываем до генерации, поэтому серия остаётся серией. Как это выглядит на практике — в кейсе Paulaner. Для СИБУР тем же способом мы делали маскотов под корпоративный курс.
Персонаж с нуля вместе с художником, исследование аудитории и бренд, в который герой встроен, — это уже большой проект от 600 000 ₽; в пакет за 120 000 ₽ это не входит.
Частые вопросы
Что спрашивают до заказа — с ответами, которые мы даём на брифе.
Можно ли сделать видео анимации AI бесплатно?
Пробные генерации есть почти у всех сервисов, но на серию их не хватит: один эпизод — это пять–шесть кадров, каждый с двумя–тремя попытками. Считайте на подписку или на оплату за использование. Бесплатного хватит ровно на то, чтобы понять, держит ли выбранная модель вашего героя.
Какая нейросеть делает анимацию персонажа из картинки?
Любая модель «картинка в видео»: вы загружаете кадр с героем и описываете действие и движение камеры. В Higgsfield для этого есть пресеты камеры и стилей; в агрегаторах вроде SYNTX можно перебрать несколько моделей на одном кадре и оставить ту, которая не ломает лицо.
Сколько времени занимает одна серия?
Первая — два–три вечера с учётом листа персонажа и притирки. Дальше эпизод на 20–30 секунд занимает вечер: раскадровка, генерация кадров с перегенерацией брака, озвучка и сборка. Утверждение героя с заказчиком в это время не входит — на нашей практике оно самое долгое.
Как сохранить одного и того же персонажа во всех роликах?
Лист персонажа в трёх ракурсах и генерация только по референсу с него, неизменное текстовое описание героя и короткие фрагменты по три–пять секунд. Плюс чеклист на каждый кадр: одежда, цвета, возраст, руки. Всё, что расходится, перегенерируется до монтажа, а не маскируется на нём.
Как это выглядит на практике




CLYOVO маскот
Tap Beer
Tap Beer New York & Miami · Paulaner





CLYOVO маскот
СИБУР
СИБУР · внутренний курс по ИИ





CLYOVO ролик
Snickers
Snickers · креативный концепт-ролик
Где это сделать самому
Инструменты, в которых собирается то, о чём статья: что делает хорошо, чего от него не ждать — и кнопка, чтобы попробовать на своей задаче.
SYNTX
Тексты, картинки, видео и музыка в одном Telegram-боте и веб-приложении: ChatGPT, Gemini, Kling, Veo, Sora, Suno и ещё сотня моделей по одной подписке. База знаний с инструкциями на русском.
- Одна подписка вместо десятка сервисов — тексты, картинки, видео, музыка
- Работает прямо в Telegram, ничего устанавливать не нужно
- Библиотека трендов: повторить популярный эффект в несколько кликов
- База знаний на русском — инструкции по каждой модели
Это подписка, а не оплата за использование: если генераций мало, посчитайте, окупится ли месяц.
Попробовать SYNTXHiggsfield
Картинки, видео и голос из текста или по референсу; движения камеры и стили для роликов, апскейл, редактирование. Веб и мобильное приложение.
- Движения камеры и кинематографичные пресеты для коротких роликов
- Картинка → видео: продукт и композиция остаются вашими
- Голос, апскейл и редактирование в том же кабинете, веб и мобильное приложение
Сильная сторона — кинематографичные короткие ролики; длинные сцены и точный текст в кадре — не его задача.
Попробовать HiggsfieldПохожая задача? План и расчёт за 24 часа
Расскажите, что нужно сделать. Подскажем, хватит ли пакета с фиксированной ценой или это проект от 600 000 ₽, и вернёмся с планом.