Бросаем телефон и попадаем в другую вселенную: 6 промптов для вирусного AI-селфи-тренда

Обычное селфи за несколько секунд превращается в сцену с гигантским кицунэ, китом, драконом или тонущим ледоколом. Разбираем механику тренда и даём 6 готовых промптов для генерации AI-видео из своего фото.

Первые секунды здесь специально выглядят максимально безобидно.

Человек снимает себя на телефон. Нюхает сакуру. Читает книгу. Подбрасывает мяч для гольфа. Пьёт что-то из банки.

А потом замечает что-то за кадром и почему-то принимает единственно разумное решение: выбрасывает телефон.

Камера летит, мир переворачивается, телефон падает набок, и только после этого становится понятно, ради чего всё затевалось. В кадре появляется гигантский девятихвостый лис, кит размером с остров, персидский кот величиной с дом или дракон, рядом с которым человек выглядит примерно как брелок.

Мы протестировали этот формат на нескольких сюжетах и собрали готовые промпты для генерации видео нейросетью.

Причём на этот раз без промптов размером с небольшую кандидатскую диссертацию.

Почему этот AI-тренд так хорошо работает

Здесь есть очень простая драматургия:

обычный кадр → странная реакция → резкий слом камеры → огромный reveal.

Первые секунды заставляют зрителя думать, что он смотрит обычное селфи. Потом происходит бросок, перспектива ломается, а финальная сцена внезапно оказывается в совершенно другом масштабе.

Есть ещё одна важная деталь: после падения телефона изображение не выравнивается.

Камера физически лежит на боку, поэтому вся сцена остаётся повёрнутой на 90 градусов. Из-за этого создаётся ощущение, будто вы действительно смотрите запись с брошенного телефона, а не очередной идеально выставленный AI-кадр.

Именно эту механику модели особенно любят ломать.

Если написать просто:

Девушка бросает телефон, после чего видит огромного лиса.

нейросеть вполне может решить, что теперь пора показать телефон со стороны, устроить монтажную склейку, выровнять горизонт и выдать лису семь с половиной хвостов.

Поэтому кое-какие правила всё-таки придётся прописать.

Как пользоваться промптами

Чтобы не повторять один и тот же технический текст шесть раз, мы разделили промпт на две части.

Сначала копируете общий блок ниже. Затем сразу после него добавляете выбранный сценарий.

@image1 — фотография вашего персонажа.

Если в сценарии используется дополнительный предмет с отдельного изображения, он обозначен как @image2.

По промокоду AISUMMER до конца лета скидка 20% на любой тариф

Для таких экспериментов удобно использовать SYNTX.AI: можно загрузить референс, протестировать разные видеомодели и перегенерировать сложные сцены, не прыгая между несколькими сервисами. А здесь перегенерации почти наверняка понадобятся. Особенно в тот момент, когда модель решит, что «ровно девять хвостов» звучит скорее как дружеская рекомендация.

Общий технический блок

Добавляйте его в начало каждого промпта.

Создай фотореалистичное вертикальное AI-видео одним непрерывным дублем. Используй загруженное изображение @image1 как точный референс главного героя. Сохраняй лицо, волосы, телосложение и одежду персонажа без изменений на протяжении всего видео. Начало ролика выглядит как естественное handheld-селфи под углом три четверти. Герой не смотрит прямо в объектив. Ключевая механика: герой замечает нечто невероятное за кадром и намеренно бросает телефон или камеру. С этого момента видео продолжается строго от первого лица, словно зритель находится внутри летящего устройства. Сам телефон или камера НИКОГДА не должны появляться в кадре, отражении или внешнем ракурсе. Во время короткого полёта видны небо, земля и окружение с естественным сильным motion blur. Затем камера падает на бок. После падения камера полностью неподвижна. Вертикальный формат сохраняется, но вся сцена внутри кадра физически повёрнута на 90 градусов. Горизонт проходит вертикально. Не выравнивай изображение до конца ролика. Финальная сцена должна быть масштабной: герой выглядит маленьким относительно главного объекта или существа. Главный объект полностью помещается в кадр. Фотореализм, естественный свет, реалистичная физика волос, одежды, травы, предметов и существ. Без монтажных склеек. Без внешнего вида телефона. Без изменения внешности героя. Без текста, субтитров, логотипов и водяных знаков. Без музыки, только естественные звуки сцены.

1. Девятихвостый кицунэ в японском саду

Красивое начало, сакура, кимоно. А потом в кадре появляется лис, которого явно забыли ограничить по размеру.

Добавьте к общему блоку:

ГЕРОИНЯ Девушка из @image1 в длинном красном атласном кимоно с золотыми драконами, чёрно-золотым поясом оби и катаной в чёрных ножнах за спиной. Катану не доставать. ЛОКАЦИЯ Японский сад на закате: цветущая сакура, каменные фонари, небольшие деревья, мягкий ветер и летящие розовые лепестки. Тёплый золотой свет постепенно переходит в прохладный вечерний. СЦЕНАРИЙ 0–4 секунды: девушка снимает себя правой рукой под углом три четверти. Наклоняется к цветущей ветке сакуры, вдыхает аромат и на секунду закрывает глаза. Затем замечает что-то далеко впереди, широко раскрывает глаза и искренне удивляется. 4–6 секунд: девушка намеренно бросает телефон. Короткий хаотичный полёт от первого лица: небо, сакура, лепестки и земля проносятся в motion blur. Телефон падает на мшистую землю и остаётся лежать на боку. 6–14 секунд: финальная сцена повёрнута на 90 градусов. Девушка стоит на коленях спиной к камере точно в центре. Рядом лежит КОЛОССАЛЬНЫЙ реалистичный кицунэ с густой пушистой шерстью и РОВНО ДЕВЯТЬЮ полностью видимыми хвостами. Лис во много раз больше девушки, но целиком помещается в кадр. Девушка гладит его. Лис медленно открывает обычные естественные глаза, довольно мурлычет и мягко оборачивает один огромный хвост вокруг девушки, словно обнимая её. ВАЖНО Ровно девять хвостов, все видны. Лис спокойный и добрый, не атакует и не показывает зубы. Глаза не светятся. Катана всё время остаётся в ножнах.

2. Персидский кот размером с дом

Ничто не подготовит человека к тому, что его потенциально раздавит кот, который вообще-то просто перевернулся во сне.

Добавьте к общему блоку:

ГЕРОЙ Мужчина из @image1. Он держит телефон только в ПРАВОЙ руке, а один маленький белый мяч для гольфа только в ЛЕВОЙ. Не менять руки и не создавать дополнительные мячи. ЛОКАЦИЯ Солнечное поле для гольфа с ярко-зелёным ухоженным газоном, фервеями, небольшими холмами и лёгким ветром. СЦЕНАРИЙ 0–4 секунды: мужчина снимает себя под углом три четверти и расслабленно подбрасывает один мяч для гольфа левой рукой, ловит его и снова подбрасывает. Телефон всё время находится в правой руке. Затем мужчина поворачивает голову, замечает что-то за кадром и искренне замирает от удивления. 4–6 секунд: мужчина намеренно бросает ТОЛЬКО телефон правой рукой. Мяч остаётся в левой. Камера коротко летит над полем и падает на бок в траву. 6–14 секунд: финальный кадр повёрнут на 90 градусов. Мужчина стоит маленьким в центре кадра ЛИЦОМ к КОЛОССАЛЬНОМУ пушистому персидскому коту. Гигантский длинношёрстный кот мирно спит на поле и полностью помещается в кадр. Сначала мужчина смотрит на него и чешет затылок. Затем кот во сне медленно перекатывается на спину в сторону мужчины. Мужчина быстро делает несколько шагов назад, чтобы его не придавило, затем останавливается. Кот остаётся спящим, лежит на спине, довольно мурлычет и трётся о траву. ВАЖНО Кот не просыпается полностью и не атакует. Мужчина не убегает, а только делает несколько шагов назад. Один мяч всё время остаётся в левой руке.

3. Кит-остров посреди цветочного луга

Если хочется чего-то менее мемного и чуть более «я случайно попала в артхаус за 200 миллионов долларов».

Добавьте к общему блоку:

ГЕРОИНЯ Девушка из @image1 держит открытую книгу в ЛЕВОЙ руке и телефон в ПРАВОЙ. ЛОКАЦИЯ Бесконечный зелёный луг с ромашками и одуванчиками. Мягкий пасмурный дневной свет, ветер двигает траву, волосы и страницы книги. СЦЕНАРИЙ 0–4 секунды: девушка снимает себя под углом три четверти и спокойно читает открытую книгу. Она не смотрит в объектив. Затем резко поднимает голову, замечает что-то огромное вдали и застывает с искренним выражением удивления. Она бросает книгу НАЗАД через левое плечо. 4–6 секунд: после книги девушка намеренно бросает телефон вверх и назад. Короткий полёт от первого лица, небо и луг проходят через кадр в motion blur. Телефон падает на бок в траву. 6–14 секунд: девушка стоит спиной к камере точно в центре бокового финального кадра. Перед ней находится КОЛОССАЛЬНЫЙ фотореалистичный кит размером с гору. Его тело покрыто густым зелёным мхом. Из поверхности выступают каменные скалы, а по спине и бокам стекают небольшие реалистичные водопады. Кит почти касается земли, но мягко ЛЕВИТИРУЕТ совсем немного над травой. Он медленно дышит и слегка покачивается в воздухе. Трава под ним двигается от вытесняемого воздуха. Кит полностью помещается в кадр от головы до хвоста и выглядит спокойным, древним и величественным. ВАЖНО Кит никогда не касается земли. Не делать обычного гладкого кита: мох, камни и водопады должны хорошо читаться. Кит не агрессивный и не открывает пасть угрожающе.

4. Тонущий ледокол вместо милого животного

Мы решили проверить, обязательно ли в финале должно появляться огромное существо.

Нет.

Можно просто утопить корабль размером с горный хребет.

Здесь используйте отдельный промпт:

Используй @image1 как точный референс молодого мужчины. Сохраняй его лицо, причёску, телосложение и одежду без изменений. Он одет совершенно не по погоде: чёрная джинсовая куртка поверх серой футболки, тёмные джинсы, без шапки и перчаток. Добавь металлический термос с отвинчивающейся чашкой. Сам термос находится в одной руке, чашка с горячим чаем в другой. ЛОКАЦИЯ Бесконечное арктическое ледовое поле у края почти чёрного замерзающего моря. Серо-белое пасмурное небо, сильный ветер, мелкий снег летит над поверхностью. КРАСНЫЙ ЛЕДОКОЛ LEVIATHAN Абсурдно огромный фотореалистичный красный ледокол размером с горный хребет. Корпус покрыт ржавчиной, льдом и следами повреждений. Огромная белая надстройка и труба с чёрным дымом. 15 секунд, вертикальный формат 9:16. 0–5 секунд: handheld-селфи под углом три четверти. Мужчина стоит на льду, дрожит от холода и осторожно пьёт горячий чай. Дыхание превращается в пар, куртка хлопает на ветру. Он не смотрит в объектив, а наблюдает за чем-то огромным впереди. 5–7 секунд: мужчина бросает пустую чашку назад через плечо, но сохраняет термос в руке. Камера резко переходит от селфи к широкой кинематографичной композиции. 7–12 секунд: мужчина стоит крошечным спиной к камере точно в центре ледового поля. Перед ним весь кадр заполняет гигантский красный ледокол, который ТОНЕТ. Нос уже ушёл под чёрную воду, корма высоко поднялась в небо, огромные винты видны над водой. Корпус деформируется, лёд ломается, с палуб стекают потоки воды, из трубы валит чёрный дым. Мужчина должен выглядеть меньше одной детали на корпусе корабля. Максимально подчеркни масштаб. 12–15 секунд: корабль окончательно исчезает под водой. Огромная волна и облако брызг расходятся по льду. Мужчина несколько секунд стоит неподвижно, затем медленно опускается на колени в снег, всё ещё держа термос. Финальный кадр: маленькая фигура на коленях перед пустым чёрным морем. СТИЛЬ Фотореалистичная катастрофа, сырая документальная съёмка, холодные серо-голубые цвета. Красный корпус корабля является единственным насыщенным цветом. Реалистичный ветер, снег, вода, разрушение металла и масштаб. Без музыки, текста, субтитров и логотипов. Только ветер, треск льда, металл, вода и звуки окружения.

5. Гигантский единорог и героиня в стиле sailor moon

Здесь тренд окончательно перестаёт делать вид, что имеет хоть какое-то отношение к нашей реальности.

И правильно.

Добавьте к общему блоку:

ГЕРОИНЯ Девушка из @image1 в образе magical girl: белое боди, тёмно-синий матросский воротник, красные банты, белые перчатки, красные сапоги и золотая тиара. За правым плечом находится тонкий декоративный серебряный меч. Глаза героини всегда обычные и естественные. Они НИКОГДА не светятся. ЛОКАЦИЯ Сказочный ночной луг: высокая серебристая трава, светящиеся цветы, лёгкий туман, полная луна, глубокое индиго-звёздное небо и медленно летящие частицы света. СЦЕНАРИЙ 0–5 секунд: героиня снимает себя под углом три четверти и всё время смотрит на огромное существо далеко впереди, а не в объектив. Она снимает меч со спины и бросает его НАЗАД через плечо. 5–6 секунд: затем бросает камеру вверх и назад. Полёт должен быть очень коротким и содержать РОВНО ОДИН чистый оборот. Камера падает в траву на бок. Первый кадр после удара уже идеально скомпонован. 6–15 секунд: финальная сцена повёрнута на 90 градусов. Героиня стоит крошечной спиной к камере точно в центре. Перед ней почти весь кадр занимает ТИТАНИЧЕСКИЙ единорог размером с многоэтажное здание. Он лежит среди цветов и спит. Жемчужно-белая реалистичная шерсть, огромная серебристо-опаловая грива, глубокие фиолетовые глаза и один гигантский полупрозрачный спиральный кристальный рог. Масштаб экстремальный: героиня рядом с ним выглядит как маленькая кукла. Единорог просыпается. Рог медленно начинает светиться мягким сине-белым светом. Он открывает глаза и плавно поднимает голову. После этого вокруг героини появляется мягкое тёплое свечение. Она медленно и невесомо поднимается вверх и садится на огромную спину единорога за холкой. Единорог остаётся спокойным и неподвижным. Героиня сидит на нём до конца кадра. ВАЖНО Ровно один единорог. Ровно один оборот камеры во время броска. Героиня никогда не смотрит в объектив. Её глаза никогда не светятся. Светиться могут только единорог, его рог, цветы и частицы. Единорог не встаёт, не атакует и не убегает.

6. Рыцарь, энергетик и дракон

Фэнтези, которое начинается так, будто сейчас будет интеграция энергетического напитка, а заканчивается встречей с существом размером со стадион.

Для этого варианта используйте два референса: @image1 для героя и @image2 для банки.

Используй @image1 как точный референс молодого андрогинного рыцаря. Сохраняй лицо и внешность без изменений. Герой полностью лысый, в полированных серебряных латах с декоративным нагрудником, длинном красном плаще и с длинным мечом. @image2 является точным референсом банки энергетического напитка. Воспроизведи её форму, цвет, надписи и графику максимально точно. ЛОКАЦИЯ Огромное зелёное поле на рассвете, покрытое густым холодным туманом. Серо-голубое пасмурное небо. Никаких зданий и деревьев. ДРАКОН КОЛОССАЛЬНЫЙ гиперреалистичный чёрный дракон BLACKWYRM: обсидиановая чешуя с лёгким радужным блеском, огромные изогнутые рога, мощные крылья, реалистичные зубы и дёсны, яркие янтарные глаза. 15 секунд, вертикальный формат 9:16. 0–5 секунд: handheld-селфи. Рыцарь стоит в туманном поле и спокойно пьёт энергетик из банки @image2. Красный плащ двигается на ветру. Герой не смотрит в объектив. 5–7 секунд: рыцарь опускает банку и замечает что-то огромное впереди. Камера резко разворачивается примерно на 90 градусов, переходя к широкой композиции. 7–12 секунд: рыцарь стоит маленьким спиной к камере в центре туманного поля. Перед ним весь кадр занимает КОЛОССАЛЬНЫЙ чёрный дракон, который спокойно спит на траве. Дракон в сотни раз больше рыцаря. Всё его тело должно помещаться в кадр. Огромная голова лежит на земле, рога и сложенные крылья хорошо видны. Из ноздрей выходит лёгкий туман. 12–15 секунд: дракон медленно просыпается, открывает яркие янтарные глаза и поднимает голову. Он раскрывает пасть и издаёт мощный рёв. Воздушная волна разгоняет туман и резко развевает красный плащ рыцаря. Рыцарь остаётся на месте и смотрит на дракона, не убегая. СТИЛЬ Гиперреалистичное live-action fantasy, холодная серо-голубая палитра, объёмный туман, реалистичный масштаб и физика. Дракон должен выглядеть как настоящее огромное живое существо, а не мультяшный персонаж. Без текста, субтитров, логотипов и музыки. Только ветер, дыхание дракона, движение брони, звук банки и мощный рёв.

Что можно менять в этих промптах

Самое интересное начинается после первой нормальной генерации.

Не обязательно оставлять именно наших персонажей и существ. Сама конструкция довольно универсальна:

селфи → герой что-то замечает → бросает камеру → перспектива ломается → reveal.

Вместо кицунэ можно поставить огромного волка.

Вместо кита — древнего левиафана.

Вместо поля для гольфа — парковку супермаркета, на которой спит динозавр.

Вместо единорога — огромного белого оленя.

А если совсем хочется посмотреть, насколько далеко можно зайти, попробуйте оставить абсолютно бытовое начало и сделать максимально абсурдный финал.

Например:

человек ждёт автобус → бросает телефон → за остановкой стоит космический корабль размером с город.

Чем сильнее контраст между первыми тремя секундами и финалом, тем лучше работает эффект.

Три вещи, которые лучше не убирать из промпта

После нескольких тестов мы бы особенно внимательно следили за тремя формулировками.

Первая: камера никогда не показывается со стороны.

Иначе модель очень любит внезапно превращать POV в красивый cinematic shot летящего смартфона. Красиво? Возможно. Но весь трюк сразу исчезает.

Вторая: после падения изображение остаётся повёрнутым на 90 градусов.

Не просто «камера падает на бок», а именно не выравнивать сцену до конца.

Модели обучены делать красивую композицию и иногда пытаются услужливо исправить ваш «неправильный» горизонт. Здесь как раз нужно убедить их ничего не исправлять.

Третья: масштаб нужно описывать буквально.

«Большой кот» недостаточно.

«Кот в сотни раз больше человека, человек выглядит крошечным, всё тело кота помещается в кадр» работает гораздо лучше.

Нейросеть не знает, насколько «огромным» вы представляете огромное. Поэтому иногда приходится объяснять ей это примерно так же подробно, как человеку, который собирается заказать вам мебель без рулетки.

И ещё один совет: не пытайтесь получить идеал с первой генерации

Такие ролики сложнее обычного image-to-video.

Здесь одновременно должны сойтись:

  • идентичность персонажа;
  • движение рук и предметов;
  • бросок;
  • физика камеры;
  • смена перспективы;
  • правильная ориентация финального кадра;
  • огромное существо;
  • масштаб;
  • взаимодействие с ним.

Если из первой генерации хорошо получились семь пунктов из девяти, это уже хороший результат.

Дальше проще точечно исправлять то, что модель не поняла.

Например:

Телефон не должен быть виден ни в одном кадре.

или:

В финале должно быть ровно девять хвостов. Каждый хвост полностью отделён от остальных и хорошо виден.

или:

После падения камера не выравнивает горизонт ни при каких условиях.

Именно поэтому нам нравится тестировать такие конструкции в SYNTX.AI: можно быстро прогонять вариации идеи через генерацию и докручивать конкретный момент, а не относиться к одному промпту как к священному тексту, который нельзя трогать.

Потому что лучший промпт для AI-видео обычно появляется не до первой генерации.

Он появляется после того, как нейросеть в третий раз совершенно уверенно показывает вам восьмихвостого девятихвостого лиса.

Теперь ваша очередь выбирать вселенную

Кицунэ, гигантский кот, парящий кит, ледокол, единорог и дракон здесь скорее примеры механики, чем законченный список.

Берите общую конструкцию, загружайте своё фото и меняйте финальный reveal на что угодно.

Мы теперь очень хотим увидеть, насколько далеко можно довести этот тренд, поэтому если попробуете повторить его в SYNTX.AI, приносите свои генерации в комментарии.

Особенно если модель внезапно придумает финал лучше вашего.

5
1