Seedance 2.5: живые 30 секунд одной генерацией - разбор по кадрам

Кадр из 30-секундной генерации Seedance 2.5
Кадр из 30-секундной генерации Seedance 2.5

31 июля ByteDance выпустил Seedance 2.5. Главная цифра релиза - 30 секунд за одну генерацию вместо прежних 15. Модель раскатывают поэтапно, API ещё закрыт, и русскоязычных разборов на живых генерациях почти нет.

ByteDance дал нам тестовый доступ к 2.5. Ниже - две наши генерации по 30 секунд целиком, без монтажа и без ускорения. Мы разобрали обе покадрово: где модель сама поставила смену плана, держится ли герой между планами, что реально лежит в файле по разрешению и звуку. Seedance 2.5 готовим к запуску в нашем боте - идёт подготовка к запуску, следите за каналом.

Почему 30 секунд - это не про длину. У всех, кто делает ИИ-видео, одна и та же боль: ролик собирается из пятисекундных кусков, и на каждом стыке пересобирается мир. Меняется лицо героя, свет, мебель за спиной. Полминуты одной генерацией убирают саму причину: склеивать нечего.

Ролик первый: пустыня, 30 секунд

Seedance 2.5, одна генерация, 30 секунд, со звуком

Сюжет разворачивается полностью: человек в бурнусе стоит на гребне дюны перед стеной песчаной бури, разворачивается, бежит вниз, камера уходит вверх до общего плана, где он превращается в точку на гребне, потом падает в крупный план на бегу - и в финале буря накрывает кадр целиком.

Главное здесь не картинка, а драматургия внутри одной генерации. Мы прогнали ролик детектором смены планов: за 30 секунд модель поставила один жёсткий монтажный стык - на 17,9 секунде, между общим планом с высоты и крупным на лице. Всё остальное - непрерывное движение камеры, включая пролёт от бегущего человека к аэросъёмке, который выглядит как склейка, а склейкой не является.

И через этот стык герой не поменялся: та же борода, тот же головной платок, тот же бурнус, тот же свет. Ровно то, что рассыпается, когда ролик собираешь из отдельных кусков.

Звук пришёл в той же генерации, отдельной дорожкой его не докладывали: ветер и шум приближающейся бури, средняя громкость −23,8 дБ. Это не тишина для галочки, дорожка живая.

Ролик второй: анимация, 30 секунд и семь планов

Seedance 2.5, одна генерация, 30 секунд, со звуком

Второй ролик - проверка на другом полюсе: не фотореализм, а рисованная 3D-анимация, и не одна сцена, а маленькая история. Лисёнок выглядывает из окна в стволе дерева, сбегает по винтовой лестнице, идёт по лесу с бобром и ежом, приходит к домику на дереве, украшенному шарами, и обнимается с друзьями под падающими листьями.

Тот же детектор нашёл здесь семь смен плана за 30 секунд: 2,5 / 7,2 / 10,2 / 13,1 / 19,0 / 22,6 / 25,7 секунды. То есть модель смонтировала полноценную сцену - общий, средний, крупный, проход со спины, финальный общий, - и это всё ещё одна генерация.

Лисёнок через все семь планов один и тот же: рыжий, зелёные глаза, белый кончик хвоста, синий шарф. Мы не давали референсов - персонаж держится сам. На 2.0 такой сюжет пришлось бы собирать из шести отдельных генераций, и на каждом стыке шарф мог бы поменять цвет.

Все модели Cyber AI в одном боте: Telegram | MAX
Seedance 2.5 готовим к запуску, 2.0 работает прямо сейчас.

Что лежит в файлах: цифры, которых нет в анонсе

Раз доступ есть, можно посмотреть не на обещания, а на то, что реально отдаёт модель. Оба файла мы проверили через ffprobe.

• Пустыня: 854 × 480, 60 кадров в секунду, 30,08 секунды, звук AAC
• Анимация: 848 × 464, 30 кадров в секунду, 29,93 секунды, звук AAC

Это важно, потому что вокруг релиза уже гуляет «нативное 4K». На официальной странице модели разрешения нет вообще. Откуда путаница: в документации 4K действительно упоминается - но применительно к входным референсам, а не к выходу. промпт-гайд по 2.5 подтверждает: выходное разрешение 2.5 не опубликовано. Наши файлы пришли в 480p, и это пока единственная измеримая цифра по теме.

60 кадров в секунду на первом ролике - тоже цифра из файла, а не из анонса. У 2.0 в техническом отчёте заявлены 24 кадра.

Что именно объявили в 2.5

Сверялись с официальной страницей модели, анонсом Dreamina и заметкой TechNode со ссылкой на китайскую Yicai.

Длина. До 30 секунд за одну генерацию против 4-15 секунд у 2.0. Готовый ролик можно продлить дважды, но на сколько секунд каждое продление - ByteDance не пишет. Поэтому «несколько минут связного повествования» относится к продлению, а не к одной генерации.

Референсы. До 50 материалов на генерацию. По данным Yicai раскладка - до 30 картинок, 10 видео и 10 аудио. Тонкость, о которой пишет XenoSpectrum: текст тоже считается в эти 50. У публичной версии 2.0 лимит был 3 видео, 9 картинок и 3 аудио.

Редактирование. Можно указать конкретный таймкод или конкретного человека в кадре и переделать только этот фрагмент. Раньше из-за одной кривой детали приходилось перегенерировать весь ролик - и вместе с ошибкой уезжало то движение и тот свет, которые как раз нравились.

Продакшен. Управление по белой модели, работа с зелёным фоном и более осмысленная работа с референсным видео: модель читает не только движение, но и композицию с операторским приёмом.

Чего в анонсе по-прежнему нет

Бенчмарков. Ни одного сравнительного теста, ни цифр по стабильности движения. «Плавнее» и «реалистичнее» - оценка самого вендора.

Открытого API. Карточка модели на BytePlus ModelArk помечена «coming soon» - статус на начало августа. Вызываемый через API Seedance по-прежнему 2.0, дату ByteDance не объявлял.

Массового доступа. Раскатка идёт поэтапно, по регионам и аккаунтам, нужна подписка и возраст от 16 лет. Наш доступ - тестовый, и это не то же самое, что открытый запуск.

Технического отчёта. Пока его нет, любые заявления про разрешение, скорость и стоимость генерации - это чужие догадки.

Что это меняет на практике

Полминуты - это уже готовый рекламный ролик, вступление к видео или законченная сцена для короткометражки. Не заготовка под монтаж, а результат.

Второе, что видно по обоим роликам: модель взяла на себя режиссуру. Она сама решает, где поставить крупный план, а где увести камеру вверх. От человека требуется описать сцену и её развитие во времени, а не расписывать раскадровку по кускам.

Пока 2.5 готовится к запуску, вся линейка видеомоделей - Seedance 2.0, Kling, Veo, Wan, Grok - работает в боте: Telegram | MAX. Промпт можно писать по-русски, перевод не нужен.

FAQ

Что такое Seedance 2.5 и чем он отличается от 2.0?

Видеомодель ByteDance, вышедшая 31 июля 2026 года. От 2.0 отличается длиной одной генерации (30 секунд против 15), количеством референсов (до 50 против 15) и возможностью переделать отдельный фрагмент ролика по таймкоду.

Сколько секунд видео можно сгенерировать за раз?

У 2.5 - до 30 секунд одной генерацией плюс два продления, длину которых ByteDance не раскрыл. Наши тестовые ролики - ровно 30,08 и 29,93 секунды.

Правда ли, что Seedance 2.5 выдаёт 4K?

Официального подтверждения нет: выходное разрешение ByteDance не публиковал. 4K в документации относится к входным референсам. Файлы, которые получили мы, - 854 × 480 и 848 × 464.

Может ли нейросеть сама сделать смену плана внутри ролика?

Да. В первом ролике модель поставила один монтажный стык за 30 секунд, во втором - семь, и персонаж между планами не менялся. Раскадровку вручную расписывать не пришлось.

Какая нейросеть для видео понимает русский промпт?

Seedance принимает описание на русском без перевода, работает и смешанный формат: описание по-русски, технические термины по-английски. Проверить на своём промпте.

Где попробовать Seedance 2.5?

Публично - в Jimeng AI и Doubao Pro, раскатка поэтапная по регионам. Через открытый API пока доступна только 2.0. Мы готовим 2.5 к запуску в боте - анонс будет в канале.

Если разбор пригодился, закиньте лайк - так он дойдёт до большего числа людей. А в комментариях расскажите, на чём у вас чаще всего рассыпается ИИ-видео: на лице, на руках или на фоне?

Анонс запуска 2.5 и разборы моделей 👉 TG | MAX

2