Все статьи
Seedance 2.5: как создавать AI-видео до 30 секунд со звуком

Seedance 2.5: как создавать AI-видео до 30 секунд со звуком

Seedance 2.5 уже доступна в Gensta: она создаёт видео из текста, одного или двух кадров и набора референсов. Разбираем длительность 5–30 секунд, синхронный звук, реальные лимиты Gensta и структуру промпта для длинной сцены.

Seedance 2.5 уже вышла — что изменилось

Seedance 2.5 — модель совместной генерации видео и звука от ByteDance. Компания официально представила её 31 июля 2026 года. Главная идея обновления — не просто сделать короткий красивый фрагмент, а собрать связную сцену: модель может создать до 30 секунд видео за один запуск, распределить действие по нескольким планам и сгенерировать звук вместе с изображением.

Для длинного ролика это особенно важно. В промпте можно задать завязку, развитие и финальный кадр, а не пытаться уместить всё действие в пять секунд. При этом 30 секунд не гарантируют идеальную непрерывность: чем больше героев, взаимодействий и резких изменений сцены, тем выше риск визуального дрейфа. ByteDance отдельно отмечает, что сложная физика и взаимодействия нескольких персонажей всё ещё остаются зонами для улучшения.

В Gensta Seedance 2.5 уже доступна в публичном генераторе. Старое сообщение этой статьи о корпоративной бете больше не актуально.

Что заявляет ByteDance и что доступно именно в Gensta

У самой модели возможностей больше, чем у любой отдельной интеграции. В официальном релизе ByteDance описывает до 30 изображений, 10 видео и 10 аудиофрагментов в одном референсном задании, многократное продолжение ролика и точечное редактирование по таймкодам.

В текущем интерфейсе Gensta доступна публичная модель Seedance 2.5 с тремя режимами: видео по тексту, видео из изображения и видео по мультимодальным референсам. Можно выбрать 5, 8, 10, 15, 20 или 30 секунд, включить синхронизированный звук и выбрать один из форматов кадра. В этой интеграции в списке качества есть 480p, 720p, 1080p и 4K.

Лимит Gensta для одного задания — до 15 файлов: не более 9 изображений, 3 видео и 3 аудиофайлов. Это лимит текущей интеграции, а не предел модели ByteDance. И наоборот: наличие функции в презентации ByteDance не означает, что она отображается как отдельная модель в интерфейсе Gensta. Основной селектор открывает три режима генерации. Редактирование и продолжение доступны через специальные пресеты «Редактировать видео Ultra» и «Продолжить видео Ultra», а не через прямой выбор скрытых model ID.

Три режима Seedance 2.5: текст, кадр или набор референсов

Видео по тексту подходит, когда исходных материалов нет. Опишите сцену, длительность, формат, действия по времени, движение камеры и звук. Модель сама строит начальный кадр и дальнейшее действие.

Видео из изображения фиксирует начало ролика. Одно фото становится первым кадром, поэтому в промпте лучше описывать не то, что уже видно, а то, что должно измениться: действие героя, движение камеры, свет и финальное состояние. Если загрузить два изображения, первое задаёт старт, а второе — последний кадр; промпт должен объяснить переход между ними. В этом режиме не нужны ссылки вида @Image1.

Режим референсов нужен, когда важно перенести внешность, товар, стиль, движение или звук, но не начинать ролик буквально с загруженного кадра. Здесь каждому материалу стоит дать одну роль: например, @Image1 отвечает только за внешность героя, @Image2 — только за товар, а @Video1 — за характер движения камеры. Чем точнее роли, тем меньше противоречий между референсами.

Создать видео в Seedance 2.5

Как написать промпт на 20–30 секунд

Длинный промпт лучше строить как короткое режиссёрское задание, а не как набор эпитетов. Сначала укажите длительность, формат и общий стиль. Затем разбейте весь хронометраж на три–пять отрезков без пробелов. Для каждого отрезка задайте одно понятное действие, одно движение камеры и связанный с ним звук. После таймлайна зафиксируйте, что должно оставаться неизменным, и закончите отдельной строкой Audio.

Пример структуры для рекламной сцены:

30-second vertical 9:16 cinematic product film, real-time speed, warm evening light.

0–6 seconds: Start on a wide street-level shot. The camera pushes from a wide frame to a medium frame as the courier places the sealed package on the counter. Paper rustles and a bicycle bell sounds outside.

6–14 seconds: The package opens and the product rises into soft light. The camera makes a measured thirty-degree arc while reflections move naturally across the surface.

14–23 seconds: Match-cut to three real-use situations, each transition motivated by the same hand movement. Keep the product shape, label colors and scale identical.

23–30 seconds: Return to a stable close-up. The product settles in the center of the frame and the camera holds for the final two seconds.

No on-screen text, subtitles, watermark, duplicated objects or changing product geometry.

Audio: room tone, paper opening at 5 seconds, a soft impact at 14 seconds, natural handling sounds, restrained music, no voiceover.

Для одной непрерывной сцены не перегружайте каждый отрезок несколькими движениями камеры. Формула «одно действие + одно движение + один звуковой акцент» обычно понятнее модели, чем «камера одновременно облетает, приближает и резко панорамирует». Текст и субтитры надёжнее добавить после генерации в редакторе.

Читать гайд по промптам

Как работать с фото, видео и аудиореференсами

Начинайте с минимального набора материалов. Один чистый референс лица и один референс стиля часто дают более понятное задание, чем девять похожих кадров. Если несколько изображений выполняют одну и ту же роль, выберите те, где объект виден чётко и без противоречий в одежде, освещении и ракурсе.

В режиме референсов подпишите назначение каждого файла прямо в промпте. Хорошая формулировка: “@Image1 is the facial-likeness reference only; do not copy its background. @Image2 defines the product shape and label colors. @Video1 defines the pace of the camera move, not the actor's identity.” Для первого кадра или пары «первый + последний кадр» такие @-ссылки использовать не нужно.

Видео- и аудиореференсы помогают передать ритм, движение, голос или атмосферу, но не превращают генерацию в покадровое копирование. Видеореференсы могут влиять на расчёт стоимости, поэтому проверяйте итоговую цену в интерфейсе до запуска. Используйте изображения и голоса только при наличии необходимых прав и законного основания; получите согласие человека, когда это требуется применимым законодательством и правилами сервиса.

Какие длительность, формат и качество выбрать

Для проверки идеи начните с 5–10 секунд и 480p или 720p. Так проще увидеть, понимает ли модель композицию, движение и роль референсов, прежде чем оплачивать длинный финальный рендер. Если черновик получился удачным, переносите тот же каркас промпта на 15–30 секунд и добавляйте промежуточные действия.

Вертикальный 9:16 подходит для Reels, Shorts и TikTok; 16:9 — для YouTube, презентаций и горизонтальной рекламы; 1:1 — для универсального поста или карточки товара. Auto полезен при анимации фотографии, когда важно сохранить её исходные пропорции.

1080p и 4K в текущем интерфейсе Gensta разумно оставлять для выбранного финального варианта: более высокое качество заметно повышает стоимость длинного ролика. Наличие 4K в интеграции Gensta не следует путать с перечнем нативных разрешений официального BytePlus API. Актуальные параметры и сумму всегда проверяйте в форме генерации непосредственно перед запуском.

Открыть пресеты Seedance 2.5

Для каких задач подходит Seedance 2.5 — и где нужен контроль

Seedance 2.5 особенно уместна там, где короткому ролику нужен сюжет: рекламная мини-история, демонстрация товара, CGI-сцена в реальной локации, оживление фотографии, видео с героем в заданном стиле или перенос характера движения из референса. Для готовых сценариев в Gensta есть отдельная коллекция пресетов Seedance 2.5 — в ней модель, промпт и последовательность шагов уже настроены под конкретный эффект.

У модели остаются ограничения. Сложные контакты нескольких людей, мелкие предметы в руках и резкая смена физики могут потребовать нескольких попыток. Длинная сцена не всегда лучше короткой: если идея состоит из независимых эпизодов, иногда надёжнее создать несколько коротких кадров и смонтировать их. Точный текст, логотип с мелкими буквами и субтитры стоит накладывать после генерации.

Не используйте чужие лица, голоса, товарные знаки или персонажей без необходимых прав. Генеративная модель помогает собрать ролик, но ответственность за исходные материалы и публикацию остаётся у автора. Отдельные Seedance 2.5 Edit и Extend не видны в model picker и не должны получать прямые model deeplinks; для этих задач в Gensta используются публичные пресеты из коллекции редактирования видео.

Открыть пресеты редактирования видео

Частые вопросы о Seedance 2.5

Seedance 2.5 уже доступна в Gensta?

Да. Откройте генератор по ссылке из этой статьи: модель sd25_ws выберется автоматически в режиме видео. Перед запуском проверьте длительность, качество, формат кадра и расчёт стоимости.

Можно ли сделать видео из фотографии?

Да. Одно изображение используется как первый кадр. Два изображения задают первый и последний кадры, а промпт описывает переход между ними. Для свободного использования изображения как образца, а не стартового кадра, выберите режим референсов.

Какая максимальная длительность ролика?

В Gensta доступны 5, 8, 10, 15, 20 и 30 секунд за один запуск. Для первой проверки идеи обычно достаточно 5–10 секунд; 20–30 секунд лучше использовать, когда у сцены есть понятный таймлайн и финал.

Seedance 2.5 создаёт видео со звуком?

Да, модель поддерживает совместную генерацию видео и синхронизированного звука. В промпте полезно привязать реплики, шумы и музыкальные акценты к конкретным отрезкам времени. Точный результат, особенно речь не на английском, стоит проверить до публикации.

Сколько референсов можно загрузить?

В текущей интеграции Gensta — до 15 файлов суммарно: не более 9 изображений, 3 видео и 3 аудиофайлов. В собственном workflow ByteDance заявлено совокупно до 50 файлов разных типов — до 30 изображений, 10 видео и 10 аудио; это не лимит интерфейса Gensta.

Поддерживает ли Seedance 2.5 разрешение 4K?

В текущей интеграции Gensta в выборе качества есть 480p, 720p, 1080p и 4K. Это описание доступных настроек Gensta, а не утверждение, что официальный BytePlus endpoint нативно выдаёт все четыре варианта. Для финальной публикации оцените реальную детализацию результата, а не только значение в селекторе.

Можно ли редактировать или продолжать готовое видео?

ByteDance показывает точечное редактирование и многократное продолжение как возможности Seedance 2.5. В Gensta отдельные модели Edit и Extend скрыты из общего селектора, но эти задачи доступны через публичные пресеты «Редактировать видео Ultra» и «Продолжить видео Ultra» в коллекции редактирования видео. Не используйте прямые ссылки с model=sd25_ws_edit или model=sd25_ws_extend.

Seedance 2.5 бесплатна?

Не обещаем бесплатный доступ. Генерация рассчитывается в кредитах; сумма зависит от выбранных параметров и, в некоторых режимах, от входного видео. Актуальная стоимость показывается в интерфейсе до запуска.

Источники и примечание об интеграции

Параметры материала проверены 27 августа 2026 года; фактическая дата обновления страницы выводится отдельно из dateModified. Возможности самой модели описаны по официальным материалам ByteDance Seed, BytePlus и CapCut; параметры Gensta — по текущей конфигурации sd25_ws и публичным пресетам. Gensta использует собственную провайдерскую интеграцию, поэтому доступные режимы, лимиты и разрешения могут отличаться от официального BytePlus endpoint и со временем меняться. Перед генерацией ориентируйтесь на настройки и расчёт в живом интерфейсе.

Все статьи