9 мин·20 сентября 2026 г.·Герман Розовик

Почему нейросеть даёт 5–8 секунд и как из этого собрать ролик на 15

Краткий ответ

Почти все видеомодели отдают клип на 5–10 секунд, и ролик на 15–30 секунд — это два-три клипа, склеенных по одному правилу: последний кадр первого клипа становится первым кадром второго. Это не ограничение вашей подписки и не ошибка в промпте, а свойство самих моделей на дату публикации. Длинное видео из них собирают монтажом, а не одной кнопкой. Ниже — почему так, как раскадровать 15 секунд на три клипа, когда продление лучше нового клипа и где стык развалится.

Почему нейросеть даёт 5–8 секунд и как из этого собрать ролик на 15
01

Почему модель отдаёт 5–10 секунд, а не минуту

Видеомодель генерирует не «видео», а последовательность кадров, каждый из которых должен согласоваться со всеми предыдущими: тот же человек, тот же свет, та же чашка на столе. Чем длиннее клип, тем больше кадров нужно держать в памяти одновременно, и на десятой секунде модель начинает забывать: меняется лицо, уплывает фон, у героя появляется третья рука. Разработчики ставят лимит там, где картинка ещё держится.

01.1

На дату публикации это выглядит так

Veo отдаёт 8 секунд за генерацию, Kling — 5 или 10, а Kling 3.0 в Higgsfield — от 3 до 15 секунд на выбор. Отдельные сервисы предлагают «продление» — модель дорисовывает ещё несколько секунд, опираясь на конец клипа. Лимиты меняются каждые несколько месяцев — перед стартом смотрите таблицу моделей в сервисе.

01.2

Практический вывод

Планируйте ролик как серию клипов с самого начала. Тогда лимит становится ритмом монтажа — в рекламе кадр и так редко длится дольше пяти секунд.

02

Правило одного стыка: последний кадр — первый кадр

02.1

Схема «клип 1 → последний кадр → клип 2» работает так

Генерируете первый клип. Вытаскиваете последний кадр — многие сервисы делают это кнопкой, иначе стоп-кадр в видеоредакторе. Загружаете кадр как стартовое изображение второго клипа и описываете в промпте, что происходит дальше. Модель начинает с той картинки, где остановился первый клип, и стык получается непрерывным.

02.2

Чтобы правило сработало, держите три вещи одинаковыми в обоих промптах

Описание героя и сцены слово в слово, положение камеры и характер света. Меняется только действие. Если в первом клипе «женщина берёт чашку, тёплый свет из окна слева, камера статична», то во втором — «женщина делает глоток, тёплый свет из окна слева, камера статична».

02.3

Одна ловушка

Последний кадр часто самый слабый — к концу модель устаёт. Если он размыт, берите кадр за полсекунды до конца и обрезайте хвост первого клипа на монтаже.

Хотите попробовать по ходу чтения? Инструменты из статьи — в один клик.

03

Раскадровка ролика на три клипа

03.1

Пятнадцать секунд — это 5+5+5 или 8+7, и каждому клипу — одно действие

Не «герой заходит, садится, открывает ноутбук и улыбается» в одном клипе: модель либо смажет всё, либо выполнит первое. Три клипа — три действия, и это уже история.

03.2

Пример для кофейни

Клип 1: дверь открывается, посетитель входит, утренний свет. Клип 2, с последнего кадра: бариста ставит чашку на стойку, пар. Клип 3, с последнего кадра: посетитель делает глоток у окна, лёгкая улыбка. Титр с названием — поверх третьего клипа на монтаже, не в генерации: текст в кадре модели пока рисуют плохо.

Все три промпта пишите до первой генерации и держите в одном документе вместе с описанием героя: так видно заранее, где действие не стыкуется. Раскадровка на бумаге стоит десять минут и экономит десяток генераций.

04

Продлить клип или сделать новый

04.1

У продления и нового клипа разные сильные стороны

Продление — функция вроде расширения видео в Higgsfield — дорисовывает несколько секунд к уже готовому клипу, сохраняя движение. Оно хорошо там, где движение медленное и предмет один: камера едет вдоль полки, течёт вода, поднимается дым. Стык невидим, потому что его делает сама модель.

04.2

Новый клип по последнему кадру лучше там, где действие меняется

Герой был у двери — теперь у стойки. Продление здесь тянет старое движение, а стартовый кадр плюс новый промпт дают контроль над тем, что происходит дальше.

04.3

Лица, текст на упаковке и быстрые движения плохо переживают оба способа

Крупный план человека лучше стыковать монтажной склейкой со сменой плана — об этом дальше. И считайте бюджет: продление стоит как отдельная генерация и удаётся не с первой попытки.

05

Где стык развалится и как его спрятать

05.1

Даже по правилу последнего кадра стык не всегда чистый

Чуть сдвинулся цвет, чуть изменилось лицо, дёрнулась камера. Проверяйте кадр стыка на полном размере, покадрово, а не на телефоне: маленький экран прощает то, что на большом заметит каждый.

05.2

Если стык виден, у вас три инструмента

Первый — монтажная склейка вместо непрерывности: смена плана с общего на крупный на стыке выглядит как режиссёрское решение, а не как ошибка. Второй — движение: если герой в конце первого клипа начинает поворачиваться, а второй клип стартует с поворота, глаз следит за движением и не замечает шва. Третий — звук и титр: непрерывная музыка и текст поверх стыка связывают клипы сильнее, чем картинка.

05.3

Полезно перебрать модели на одной паре промптов

Одна держит лицо, другая свет. Удобно там, где несколько моделей доступны по одной подписке — например в SYNTX, где есть Kling, Veo и другие.

06

Так собран ролик Snickers

Наш ролик для Snickers — героиня в пустыне внутри мёртвого завода, превращение в робота-зверя и обратно — сделан без единого съёмочного дня и целиком собран из коротких клипов. Каждая сцена — отдельная генерация на несколько секунд, стыки спрятаны в монтаже, а свет и персонажи держались благодаря подробному описанию, повторявшемуся в каждом промпте слово в слово.

06.1

Что мы вынесли из этого проекта

Персонаж описывается один раз и фиксируется листом: одежда, лицо, пропорции, стиль. Каждая сцена — одно действие. На каждый клип закладывается несколько попыток, кадр стыка выбирается из них. Монтаж и звук делают половину работы по склейке.

06.2

Ролик собирали дни, а не месяцы, но и не за вечер

На кинематографичную картинку уходят десятки попыток. Для ролика кофейни столько не нужно, принцип тот же. Кейс целиком — с роликом.

07

Когда 15 секунд можно собрать самому и когда нужна серия

Один ролик для сторис или ленты собирайте сами: вечер на раскадровку и три клипа, второй — на монтаж. Как собрать ролик из текста целиком, мы писали отдельно.

Границы начинаются, когда роликов нужно много и они должны быть похожи друг на друга: один герой, один стиль, один бренд — и так двадцать раз. Тогда каждый стык умножается на двадцать, а описание героя должно держаться от первого ролика до последнего. На это и рассчитан пакет 20 роликов по 10 секунд за 120 000 ₽: персонаж и стиль собираются один раз, раскадровку мы показываем до генерации, стыки и звук — наша работа.

Когда в ролике нужен реальный продукт в руках, съёмка с актёром и графика на заказ, это большой проект от 600 000 ₽ — с исследованием аудитории и менеджером. Нейросеть там тоже есть, но уже как один из инструментов, а не единственный.

Частые вопросы

Что спрашивают до заказа — с ответами, которые мы даём на брифе.

Почему нейросеть делает видео только 5 секунд?

Потому что каждый новый кадр должен согласоваться со всеми предыдущими, и на длинном клипе модель начинает терять лицо, фон и предметы. Разработчики ставят лимит там, где картинка ещё держится: на дату публикации это обычно 5–10 секунд за генерацию, у отдельных моделей до 15.

Как сделать видео нейросетью длиннее 10 секунд?

Двумя способами: продлить клип функцией расширения, если движение медленное и предмет один, или сгенерировать следующий клип с последнего кадра предыдущего и склеить на монтаже. Для ролика на 15–30 секунд второй способ надёжнее — вы контролируете, что происходит в каждом клипе.

Какая нейросеть делает видео 15 секунд?

На дату публикации Kling 3.0 в Higgsfield отдаёт клипы до 15 секунд, Veo — 8 секунд с возможностью продления. Но одним клипом 15 секунд редко получаются хорошо: действие смазывается. Три клипа по 5 секунд с одним действием в каждом выглядят лучше и дешевле в попытках.

Как склеить два клипа нейросети, чтобы не было видно стыка?

Возьмите последний чёткий кадр первого клипа как стартовое изображение второго, повторите описание сцены, света и камеры слово в слово и меняйте только действие. Если шов всё же виден, спрячьте его сменой плана, движением героя через стык и непрерывной музыкой.

Как это выглядит на практике

Где это сделать самому

Инструменты, в которых собирается то, о чём статья: что делает хорошо, чего от него не ждать — и кнопка, чтобы попробовать на своей задаче.

100+ нейросетей в Telegram и на сайте по одной подписке

SYNTX

Тексты, картинки, видео и музыка в одном Telegram-боте и веб-приложении: ChatGPT, Gemini, Kling, Veo, Sora, Suno и ещё сотня моделей по одной подписке. База знаний с инструкциями на русском.

  • Одна подписка вместо десятка сервисов — тексты, картинки, видео, музыка
  • Работает прямо в Telegram, ничего устанавливать не нужно
  • Библиотека трендов: повторить популярный эффект в несколько кликов
  • База знаний на русском — инструкции по каждой модели

Это подписка, а не оплата за использование: если генераций мало, посчитайте, окупится ли месяц.

Попробовать SYNTX
Кино-ролики из картинки и текста

Higgsfield

Картинки, видео и голос из текста или по референсу; движения камеры и стили для роликов, апскейл, редактирование. Веб и мобильное приложение.

  • Движения камеры и кинематографичные пресеты для коротких роликов
  • Картинка → видео: продукт и композиция остаются вашими
  • Голос, апскейл и редактирование в том же кабинете, веб и мобильное приложение

Сильная сторона — кинематографичные короткие ролики; длинные сцены и точный текст в кадре — не его задача.

Попробовать Higgsfield

Похожая задача? План и расчёт за 24 часа

Расскажите, что нужно сделать. Подскажем, хватит ли пакета с фиксированной ценой или это проект от 600 000 ₽, и вернёмся с планом.