7 шагов чтобы заменить локацию в готовом ролике и не сломать актёра
Головная боль любого креатора - клиент приносит уже снятый ролик и говорит "поменяй фон, подними качество и замени текст. Остальное не трогай".
Остальное не трогать - это внешность актёра, его движения, пластику, момент когда он показывает продукт, выход из двери. Всё что делает ролик роликом а не набором кадров. Звучит несложно, но на самом деле это та еще головная боль 😬
Короче, вот рабочий алгоритм, как это делается.
Шаг 1. Собери все исходники до первой генерации
Берёшь исходный ролик и нарезаешь на куски - отдельно начало, середина, конец. Отдельно вытаскиваешь первый и последний кадр как статичные изображения. Новую локацию генеришь заранее в нужном качестве и освещении, она пойдёт как отдельный референс. Аудио с новым текстом записываешь до начала работы с видео. Пока всё это не готово, не запускаешь ни одной генерации.
Шаг 2. Движение и качество - два разных источника в промпте
В промпте явно указываешь: пластику, камеру и тайминг брать с исходного ролика. Резкость, цвет и детализацию - с изображения новой локации. Буквально двумя отдельными строками. Не объединяй это в одно условие, модель выберет одно и проигнорирует второе.
Шаг 3. Промпт собирай по одному условию за проход
Первый проход: только замена фона, больше ничего. Смотришь что получилось.
Второй проход: добавляешь возврат лица актёра.
Третий: рука с продуктом.
Четвёртый: выход из двери.
Пятый: звук. Каждый раз одна новая задача поверх того что уже работает. Если напишешь всё сразу - модель потеряет приоритеты и сломает то что уже было ок 🦍
Шаг 4. Первый и последний кадр вставляй как якоря
Когда пластика начинает уходить от оригинала - берёшь те два статичных кадра которые вытащил на шаге 1 и добавляешь в работу как дополнительные референсы. Не весь ролик -только эти два кадра. Они фиксируют внешность героя и общую композицию сцены без лишней нагрузки на модель.
Шаг 5. Каждый объект в кадре фиксируй явно и отдельно
В промпте отдельной строкой: дверь одна, та из которой выходит актёр. Отдельной строкой: продукт в руке читаемый, форма не меняется. Отдельной строкой: одежда как в оригинале. Отдельной строкой: порядок действий - дверь, выход, проход, показ продукта. Если не написал, модель додумает сама.
Шаг 6. Четыре фото актёра в один коллаж
Берёшь 4 актуальных фотографии актёра - не кадры из старых роликов, а свежие фото как он выглядит сейчас. Склеиваешь в один коллаж в любом редакторе. Этот коллаж идёт дополнительным референсом рядом с исходным роликом. Внешность держится на протяжении всего ролика, а не только в первом кадре.
Шаг 7. Липсинг - отдельный этап
Когда картинка и движения тебя полностью устраивают - только тогда берёшь готовый ролик и аудио с новым текстом и идёшь в отдельный инструмент заточенный под артикуляцию. Язык реплики прописываешь явно - одной строкой в промпте. Если не укажешь, модель будет угадывать и артикуляция поплывёт.
Чем точнее собрал всё на старте - тем меньше итераций потом. Один проход вместо двадцати начинается с шага 1.
Забирайте и делитесь в комментах, какие вопросы вы бы хотели, чтобы я ещё разобрал с технической стороны АИ-продакшена 👇
Подписывайтесь на Telegram Лев x Алекс / AI Adepts.