Бросаем телефон и попадаем в другую вселенную: 6 промптов для вирусного AI-селфи-тренда
Обычное селфи за несколько секунд превращается в сцену с гигантским кицунэ, китом, драконом или тонущим ледоколом. Разбираем механику тренда и даём 6 готовых промптов для генерации AI-видео из своего фото.
Первые секунды здесь специально выглядят максимально безобидно.
Человек снимает себя на телефон. Нюхает сакуру. Читает книгу. Подбрасывает мяч для гольфа. Пьёт что-то из банки.
А потом замечает что-то за кадром и почему-то принимает единственно разумное решение: выбрасывает телефон.
Камера летит, мир переворачивается, телефон падает набок, и только после этого становится понятно, ради чего всё затевалось. В кадре появляется гигантский девятихвостый лис, кит размером с остров, персидский кот величиной с дом или дракон, рядом с которым человек выглядит примерно как брелок.
Мы протестировали этот формат на нескольких сюжетах и собрали готовые промпты для генерации видео нейросетью.
Причём на этот раз без промптов размером с небольшую кандидатскую диссертацию.
Почему этот AI-тренд так хорошо работает
Здесь есть очень простая драматургия:
обычный кадр → странная реакция → резкий слом камеры → огромный reveal.
Первые секунды заставляют зрителя думать, что он смотрит обычное селфи. Потом происходит бросок, перспектива ломается, а финальная сцена внезапно оказывается в совершенно другом масштабе.
Есть ещё одна важная деталь: после падения телефона изображение не выравнивается.
Камера физически лежит на боку, поэтому вся сцена остаётся повёрнутой на 90 градусов. Из-за этого создаётся ощущение, будто вы действительно смотрите запись с брошенного телефона, а не очередной идеально выставленный AI-кадр.
Именно эту механику модели особенно любят ломать.
Если написать просто:
Девушка бросает телефон, после чего видит огромного лиса.
нейросеть вполне может решить, что теперь пора показать телефон со стороны, устроить монтажную склейку, выровнять горизонт и выдать лису семь с половиной хвостов.
Поэтому кое-какие правила всё-таки придётся прописать.
Как пользоваться промптами
Чтобы не повторять один и тот же технический текст шесть раз, мы разделили промпт на две части.
Сначала копируете общий блок ниже. Затем сразу после него добавляете выбранный сценарий.
@image1 — фотография вашего персонажа.
Если в сценарии используется дополнительный предмет с отдельного изображения, он обозначен как @image2.
По промокоду AISUMMER до конца лета скидка 20% на любой тариф
Для таких экспериментов удобно использовать SYNTX.AI: можно загрузить референс, протестировать разные видеомодели и перегенерировать сложные сцены, не прыгая между несколькими сервисами. А здесь перегенерации почти наверняка понадобятся. Особенно в тот момент, когда модель решит, что «ровно девять хвостов» звучит скорее как дружеская рекомендация.
Общий технический блок
Добавляйте его в начало каждого промпта.
1. Девятихвостый кицунэ в японском саду
Красивое начало, сакура, кимоно. А потом в кадре появляется лис, которого явно забыли ограничить по размеру.
Добавьте к общему блоку:
2. Персидский кот размером с дом
Ничто не подготовит человека к тому, что его потенциально раздавит кот, который вообще-то просто перевернулся во сне.
Добавьте к общему блоку:
3. Кит-остров посреди цветочного луга
Если хочется чего-то менее мемного и чуть более «я случайно попала в артхаус за 200 миллионов долларов».
Добавьте к общему блоку:
4. Тонущий ледокол вместо милого животного
Мы решили проверить, обязательно ли в финале должно появляться огромное существо.
Нет.
Можно просто утопить корабль размером с горный хребет.
Здесь используйте отдельный промпт:
5. Гигантский единорог и героиня в стиле sailor moon
Здесь тренд окончательно перестаёт делать вид, что имеет хоть какое-то отношение к нашей реальности.
И правильно.
Добавьте к общему блоку:
6. Рыцарь, энергетик и дракон
Фэнтези, которое начинается так, будто сейчас будет интеграция энергетического напитка, а заканчивается встречей с существом размером со стадион.
Для этого варианта используйте два референса: @image1 для героя и @image2 для банки.
Что можно менять в этих промптах
Самое интересное начинается после первой нормальной генерации.
Не обязательно оставлять именно наших персонажей и существ. Сама конструкция довольно универсальна:
селфи → герой что-то замечает → бросает камеру → перспектива ломается → reveal.
Вместо кицунэ можно поставить огромного волка.
Вместо кита — древнего левиафана.
Вместо поля для гольфа — парковку супермаркета, на которой спит динозавр.
Вместо единорога — огромного белого оленя.
А если совсем хочется посмотреть, насколько далеко можно зайти, попробуйте оставить абсолютно бытовое начало и сделать максимально абсурдный финал.
Например:
человек ждёт автобус → бросает телефон → за остановкой стоит космический корабль размером с город.
Чем сильнее контраст между первыми тремя секундами и финалом, тем лучше работает эффект.
Три вещи, которые лучше не убирать из промпта
После нескольких тестов мы бы особенно внимательно следили за тремя формулировками.
Первая: камера никогда не показывается со стороны.
Иначе модель очень любит внезапно превращать POV в красивый cinematic shot летящего смартфона. Красиво? Возможно. Но весь трюк сразу исчезает.
Вторая: после падения изображение остаётся повёрнутым на 90 градусов.
Не просто «камера падает на бок», а именно не выравнивать сцену до конца.
Модели обучены делать красивую композицию и иногда пытаются услужливо исправить ваш «неправильный» горизонт. Здесь как раз нужно убедить их ничего не исправлять.
Третья: масштаб нужно описывать буквально.
«Большой кот» недостаточно.
«Кот в сотни раз больше человека, человек выглядит крошечным, всё тело кота помещается в кадр» работает гораздо лучше.
Нейросеть не знает, насколько «огромным» вы представляете огромное. Поэтому иногда приходится объяснять ей это примерно так же подробно, как человеку, который собирается заказать вам мебель без рулетки.
И ещё один совет: не пытайтесь получить идеал с первой генерации
Такие ролики сложнее обычного image-to-video.
Здесь одновременно должны сойтись:
- идентичность персонажа;
- движение рук и предметов;
- бросок;
- физика камеры;
- смена перспективы;
- правильная ориентация финального кадра;
- огромное существо;
- масштаб;
- взаимодействие с ним.
Если из первой генерации хорошо получились семь пунктов из девяти, это уже хороший результат.
Дальше проще точечно исправлять то, что модель не поняла.
Например:
Телефон не должен быть виден ни в одном кадре.
или:
В финале должно быть ровно девять хвостов. Каждый хвост полностью отделён от остальных и хорошо виден.
или:
После падения камера не выравнивает горизонт ни при каких условиях.
Именно поэтому нам нравится тестировать такие конструкции в SYNTX.AI: можно быстро прогонять вариации идеи через генерацию и докручивать конкретный момент, а не относиться к одному промпту как к священному тексту, который нельзя трогать.
Потому что лучший промпт для AI-видео обычно появляется не до первой генерации.
Он появляется после того, как нейросеть в третий раз совершенно уверенно показывает вам восьмихвостого девятихвостого лиса.
Теперь ваша очередь выбирать вселенную
Кицунэ, гигантский кот, парящий кит, ледокол, единорог и дракон здесь скорее примеры механики, чем законченный список.
Берите общую конструкцию, загружайте своё фото и меняйте финальный reveal на что угодно.
Мы теперь очень хотим увидеть, насколько далеко можно довести этот тренд, поэтому если попробуете повторить его в SYNTX.AI, приносите свои генерации в комментарии.
Особенно если модель внезапно придумает финал лучше вашего.