ByteDance

Seedance 2

Seedance 2.5 объединяет генерацию по тексту и необязательное управление изображениями, видео и аудио в одной флагманской задаче. Она поддерживает вывод 480p и 720p длительностью от 4 до 15 секунд, до девяти изображений, трёх видео и трёх аудиореференсов. Seedance 2.0 остаётся доступной в версиях Full, Fast и Mini; у каждой есть LR-вариант с более мягкой фильтрацией промптов для сокращения ложных отказов.

Как пользоваться моделью

  1. 1

    Выбирайте 2.5 для флагманского сценария; используйте Seedance 2.0 LR, когда важна вероятность принятия промпта или стандартная версия 2.0 отклонила безобидный запрос.

  2. 2

    В промпте назначьте каждому референсу понятную роль — например персонаж, локация, движение камеры, ритм движения или звуковая дорожка.

  3. 3

    Для генерации по первому и последнему кадрам загрузите оба изображения и опишите действие, которое правдоподобно связывает их.

  4. 4

    Если нужен нативный звук, отдельно укажите реплики, атмосферу, эффекты и музыку.

  5. 5

    Используйте Fast или Mini для итераций, а перед финалом сравните выбранную версию на тех же промпте и референсах.

2.5Доступна

2.5

Seedance 2.5 использует единый мультимодальный сценарий для генерации по тексту и референсам. Добавьте до девяти изображений, трёх видео и трёх аудиореференсов, затем обращайтесь к ним в промпте по позиции. Результат доступен в 480p или 720p длительностью 4–15 секунд; добавленное изображение определяет соотношение сторон.

Свойства

  • Единый тип задачи для генерации по тексту и смешанным референсам изображений, видео и аудио.
  • Поддерживает до девяти изображений, трёх видео и трёх аудиореференсов.

Лучше всего подходит

  • Высококачественная генерация видео из текста
  • Управление внешним видом и стилем по изображениям
  • Смешанные референсы изображений, видео и аудио

Не рекомендуется

  • Вывод в 1080p, вывод длительностью более 15 секунд или генерация только по аудиореференсу

Советы

  • Добавляйте только те референсы изображений, видео и аудио, которые нужны для результата.
  • Используйте @imageN, @videoN и @audioN в запросе для обращения к ссылкам по позиции.

Как пользоваться моделью

  1. 1

    Начните с чёткого последовательного описания сцены, движения, камеры и звука.

  2. 2

    Добавляйте только те референсы изображений, видео и аудио, которые нужны для результата.

  3. 3

    Используйте @imageN, @videoN и @audioN, чтобы обозначить каждый референс в промпте.

  4. 4

    Выберите 480p или 720p и длительность от 4 до 15 секунд.

Параметры

Промпт

Обязательно

Текстовое описание желаемой сцены, движения и действия.

Разрешение

Необязательно

Разрешение выходного видео. Этот уровень не поддерживает 1080p.

  • 480p

  • 720p

Длительность

Необязательно

Длительность сгенерированного видео в секундах.

Соотношение сторон

Необязательно

Соотношение сторон результата. При наличии референсного изображения его соотношение сторон имеет приоритет.

  • 21:9

  • 16:9

  • 4:3

  • 1:1

  • 3:4

  • 9:16

  • Авто

Референсные изображения

Необязательно

До девяти изображений для управления внешним видом, содержанием или стилем.

Референсные видео

Необязательно

До трёх референсов движения, содержимого или стиля общей длительностью не более 15,4 секунды.

Референсное аудио

Необязательно

До трёх референсов MP3, OGG, WAV, M4A или AAC; для аудио требуется референсное изображение или видео.

2.0Доступна

2.0

Полный сценарий Seedance 2.0 генерирует по тексту, анимирует первый кадр, строит переход к последнему кадру или использует несколько типов референсов. Это структурированные входы: для интерполяции применяйте отдельные поля первого/последнего кадра, а для мультимодального управления — коллекции референсов.

Свойства

  • Входы: промпт, необязательные первый/последний кадры и референсы изображений, видео или аудио.
  • Настройки включают длительность, разрешение, соотношение сторон, seed и нативный звук.

Как пользоваться моделью

  1. 1

    Выберите генерацию по тексту, первому кадру, первому/последнему кадрам или мультимодальным референсам.

  2. 2

    Назначьте каждому изображению, видео или аудиореференсу конкретную роль в промпте.

  3. 3

    Совместно задайте длительность, разрешение, соотношение сторон и генерацию нативного звука.

  4. 4

    Проверьте стабильность персонажей, следование референсам, движение и синхронизацию звука.

Примеры

Параметры

Seed

Необязательно

Случайное зерно. Установите для воспроизводимой генерации.

Изображение

Необязательно

Входное изображение для генерации видео из изображения (первый кадр). Нельзя комбинировать с опорными изображениями.

Промпт

Обязательно

Текстовое описание для генерации видео. Максимум 4000 символов. Для лучших результатов используйте не более 600 английских слов.

Длительность

Необязательно

Длительность видео в секундах. Автоматическая длительность недоступна, так как генерация рассчитывается и резервируется до завершения обработки.

Разрешение

Необязательно

Разрешение видео. 4K выводит 10-битный H.265/HEVC с высоким битрейтом.

  • 480p

  • 720p

  • 1080p

  • 4k

Соотношение сторон

Необязательно

Соотношение сторон видео. Установите adaptive, чтобы позволить модели выбрать наилучшее соотношение на основе входных данных.

  • 21:9

  • 16:9

  • 4:3

  • 1:1

  • 3:4

  • 9:16

  • 9:21

  • Адаптивный

Сгенерировать аудио

Необязательно

Сгенерировать аудио, синхронизированное с видео, включая диалоги, звуковые эффекты и фоновую музыку.

Изображение последнего кадра

Необязательно

Входное изображение для генерации последнего кадра. Работает только в том случае, если также предоставлено изображение первого кадра. Нельзя комбинировать с опорными изображениями.

Референсные аудио

Необязательно

Референсные аудиофайлы для генерации на основе звука и липсинка. Требуется как минимум одно референсное изображение или видео. Указывайте их в запросе как [Audio1], [Audio2] и т.д.

Референсные изображения

Необязательно

Референсные изображения для согласованности персонажей, руководства стилем и композиции сцены. Нельзя использовать вместе с изображениями первого/последнего кадра.

Референсные видео

Необязательно

Референсные видео для переноса движения, руководства стилем и редактирования. Указывайте их в запросе как [Video1], [Video2] и т.д.

Рекомендуем2.0Доступна

2.0 LR

LR означает Less Restrictive и рекомендуется как полнофункциональный вариант Seedance 2.0, когда важна вероятность принятия промпта. Он существенно сокращает ложные срабатывания модерации, которые могут блокировать безобидные запросы или синтетических людей, сохраняя полный сценарий с текстом, кадрами, изображениями, видео и аудио. Фильтрация допускает запросы вплоть до уровня NSFW; правила платформы продолжают действовать, поэтому принятие не гарантируется. Omnipix определяет режим по добавленным входам.

Начинайте здесь, если обычный Seedance отклоняет безобидные промпты. Full LR сохраняет полное качество и использует существенно более мягкую фильтрацию — в том числе для синтетических людей и запросов вплоть до уровня NSFW, при соблюдении правил платформы.

Свойства

  • Менее строгая фильтрация промптов, включая запросы вплоть до уровня NSFW.
  • Автоматический выбор текстового, кадрового или мультимодального сценария по входам.

Лучше всего подходит

  • Генерация видео из текста
  • Управление первым и последним кадром
  • Смешанные ссылки на изображения, видео и аудио

Не рекомендуется

  • Вывод длительностью более 15 секунд

Советы

  • Omnipix автоматически определяет генерацию по тексту, кадрам или мультимодальным референсам по добавленным входам.
  • Используйте @imageN, @videoN и @audioN в запросе для обращения к ссылкам по позиции.

Как пользоваться моделью

  1. 1

    Не добавляйте материалы для text-to-video, используйте один-два кадра для управления кадрами или изображения, видео и аудио для мультимодального управления.

  2. 2

    Выбирайте LR осознанно, когда промпту нужна менее строгая фильтрация, включая контент уровня NSFW.

  3. 3

    Опишите, как каждый источник должен влиять на результат.

  4. 4

    Настройте результат и после генерации проверьте следование референсам.

Примеры

Параметры

Промпт

Обязательно

Текстовое описание желаемой сцены, движения и действия.

Разрешение

Необязательно

Разрешение выходного видео.

  • 480p

  • 720p

  • 1080p

Длительность

Необязательно

Длительность сгенерированного видео в секундах.

Соотношение сторон

Необязательно

Соотношение сторон результата. Auto позволяет модели определить его по добавленным кадрам.

  • 21:9

  • 16:9

  • 4:3

  • 1:1

  • 3:4

  • 9:16

  • Авто

Референсные изображения

Необязательно

Одно или два изображения могут задать первый и последний кадры; более крупные наборы изображений используются для мультимодального управления.

Референсные видео

Необязательно

Необязательные референсы движения или стиля для мультимодального управления.

Референсное аудио

Необязательно

Необязательные аудиореференсы MP3 или WAV; для аудио требуется изображение или видео.

2.0 FastДоступна

2.0 Fast

Используйте Fast для более коротких итераций, сохраняя text-to-video, image-to-video, первый/последний кадры и мультимодальные референсы. Поскольку набор входов совпадает с полной версией, один и тот же промпт и референсы можно сравнивать напрямую.

Свойства

  • Ускоренный вариант с текстовыми, графическими, видео- и аудиореференсами.
  • Поддерживает управление первым/последним кадрами и необязательную генерацию звука.

Как пользоваться моделью

  1. 1

    Подготовьте промпт и набор референсов так же, как для полной версии Seedance 2.0.

  2. 2

    Для заданного перехода используйте поля первого/последнего кадра, а не общую коллекцию референсов.

  3. 3

    До запуска итерации задайте параметры результата и звука.

  4. 4

    При выборе финального рендера сравнивайте Fast и полную версию на одинаковых входах.

Параметры

Seed

Необязательно

Случайное зерно. Установите для воспроизводимой генерации.

Изображение

Необязательно

Входное изображение для генерации видео из изображения (первый кадр). Нельзя комбинировать с опорными изображениями.

Промпт

Обязательно

Текстовое описание для генерации видео. Максимум 4000 символов. Для лучших результатов используйте не более 600 английских слов.

Длительность

Необязательно

Длительность видео в секундах. Автоматическая длительность недоступна, так как генерация рассчитывается и резервируется до завершения обработки.

Разрешение

Необязательно

Разрешение видео.

  • 480p

  • 720p

Соотношение сторон

Необязательно

Соотношение сторон видео. Установите adaptive, чтобы позволить модели выбрать наилучшее соотношение на основе входных данных.

  • 21:9

  • 16:9

  • 4:3

  • 1:1

  • 3:4

  • 9:16

  • 9:21

  • Адаптивный

Сгенерировать аудио

Необязательно

Сгенерировать аудио, синхронизированное с видео, включая диалоги, звуковые эффекты и фоновую музыку.

Изображение последнего кадра

Необязательно

Входное изображение для генерации последнего кадра. Работает только в том случае, если также предоставлено изображение первого кадра. Нельзя комбинировать с опорными изображениями.

Референсные аудио

Необязательно

Референсные аудиофайлы для генерации на основе звука и липсинка. Требуется как минимум одно референсное изображение или видео. Указывайте их в запросе как [Audio1], [Audio2] и т.д.

Референсные изображения

Необязательно

Референсные изображения для согласованности персонажей, руководства стилем и композиции сцены. Нельзя использовать вместе с изображениями первого/последнего кадра.

Референсные видео

Необязательно

Референсные видео для переноса движения, руководства стилем и редактирования. Указывайте их в запросе как [Video1], [Video2] и т.д.

Рекомендуем2.0Доступна

2.0 Fast LR

Fast LR рекомендуется для итераций, когда стандартный Seedance отклоняет безобидные промпты или синтетических людей. Он сохраняет работу Seedance 2.0 Fast с изображениями, видео и аудиореференсами, существенно сокращая ложные срабатывания модерации. Допускаются промпты вплоть до уровня NSFW при соблюдении правил платформы, но принятие не гарантируется. Сценарий определяется по входам.

Выбирайте Fast LR для быстрых итераций с существенно меньшим числом ложных отказов, включая безобидные сцены с синтетическими людьми. Поддерживаются запросы вплоть до уровня NSFW при соблюдении правил платформы.

Свойства

  • Ускоренная генерация с автоматическим выбором мультимодального сценария.
  • Менее строгая фильтрация, включая промпты вплоть до уровня NSFW.

Лучше всего подходит

  • Генерация видео из текста
  • Управление первым и последним кадром
  • Смешанные ссылки на изображения, видео и аудио

Не рекомендуется

  • Вывод в 1080p или вывод длительностью более 15 секунд

Советы

  • Omnipix автоматически определяет генерацию по тексту, кадрам или мультимодальным референсам по добавленным входам.
  • Используйте @imageN, @videoN и @audioN в запросе для обращения к ссылкам по позиции.

Как пользоваться моделью

  1. 1

    Добавьте только нужные сценарию материалы; Omnipix определит режим по этим входам.

  2. 2

    Добавьте только необходимые URL и обозначьте их в промпте.

  3. 3

    Задайте длительность, разрешение и соотношение сторон результата.

  4. 4

    Проверяйте использование референсов, движение и звук вместе.

Параметры

Промпт

Обязательно

Текстовое описание желаемой сцены, движения и действия.

Разрешение

Необязательно

Разрешение выходного видео. Этот уровень не поддерживает 1080p.

  • 480p

  • 720p

Длительность

Необязательно

Длительность сгенерированного видео в секундах.

Соотношение сторон

Необязательно

Соотношение сторон результата. Auto позволяет модели определить его по добавленным кадрам.

  • 21:9

  • 16:9

  • 4:3

  • 1:1

  • 3:4

  • 9:16

  • Авто

Референсные изображения

Необязательно

Одно или два изображения могут задать первый и последний кадры; более крупные наборы изображений используются для мультимодального управления.

Референсные видео

Необязательно

Необязательные референсы движения или стиля для мультимодального управления.

Референсное аудио

Необязательно

Необязательные аудиореференсы MP3 или WAV; для аудио требуется изображение или видео.

2.0Доступна

2.0 Mini

Mini предоставляет ту же базовую структуру текста и референсов в уменьшенном варианте Seedance. Omnipix определяет сценарий по добавленным материалам. Используйте его для ранних проб и организуйте промпт и источники так, чтобы удачную конфигурацию можно было без изменений перенести в другую версию.

Свойства

  • Вариант Mini с промптом и входами изображений, видео и аудио.
  • Автоматически определяет сценарий по добавленным входам.

Лучше всего подходит

  • Генерация видео из текста
  • Управление первым и последним кадром
  • Смешанные ссылки на изображения, видео и аудио

Не рекомендуется

  • Вывод в 1080p или вывод длительностью более 15 секунд

Советы

  • Omnipix автоматически определяет генерацию по тексту, кадрам или мультимодальным референсам по добавленным входам.
  • Используйте @imageN, @videoN и @audioN в запросе для обращения к ссылкам по позиции.

Как пользоваться моделью

  1. 1

    Соберите минимально необходимый набор референсов; сценарий определится по добавленным материалам.

  2. 2

    Опишите роль каждого источника и развитие кадра.

  3. 3

    До генерации задайте длительность, разрешение и соотношение сторон.

  4. 4

    Сохраните точные промпт и входы при переносе удачного черновика в другую версию.

Параметры

Промпт

Обязательно

Текстовое описание желаемой сцены, движения и действия.

Разрешение

Необязательно

Разрешение выходного видео. Этот уровень не поддерживает 1080p.

  • 480p

  • 720p

Длительность

Необязательно

Длительность сгенерированного видео в секундах.

Соотношение сторон

Необязательно

Соотношение сторон результата. Auto позволяет модели определить его по добавленным кадрам.

  • 21:9

  • 16:9

  • 4:3

  • 1:1

  • 3:4

  • 9:16

  • Авто

Референсные изображения

Необязательно

Одно или два изображения могут задать первый и последний кадры; более крупные наборы изображений используются для мультимодального управления.

Референсные видео

Необязательно

Необязательные референсы движения или стиля для мультимодального управления.

Референсное аудио

Необязательно

Необязательные аудиореференсы MP3 или WAV; для аудио требуется изображение или видео.

Рекомендуем2.0Доступна

2.0 Mini LR

Mini LR рекомендуется как экономичный стартовый вариант, когда обычный Seedance отклоняет безобидные промпты или синтетических людей. Он сочетает компактный сценарий Seedance с автоматическим определением задачи и существенно более мягкой фильтрацией, принимая запросы вплоть до уровня NSFW при соблюдении правил платформы. Принятие не гарантируется.

Выбирайте Mini LR для экономичных проб с существенно меньшим числом ложных отказов, включая безобидные сцены с синтетическими людьми. Поддерживаются запросы вплоть до уровня NSFW при соблюдении правил платформы.

Свойства

  • Компактная генерация с автоматическим выбором мультимодального сценария.
  • Менее строгая фильтрация, включая промпты вплоть до уровня NSFW.

Лучше всего подходит

  • Генерация видео из текста
  • Управление первым и последним кадром
  • Смешанные ссылки на изображения, видео и аудио

Не рекомендуется

  • Вывод в 1080p или вывод длительностью более 15 секунд

Советы

  • Omnipix автоматически определяет генерацию по тексту, кадрам или мультимодальным референсам по добавленным входам.
  • Используйте @imageN, @videoN и @audioN в запросе для обращения к ссылкам по позиции.

Как пользоваться моделью

  1. 1

    Добавьте только нужные задаче источники; Omnipix определит режим автоматически.

  2. 2

    Добавьте только относящиеся к задаче изображения, видео и аудио.

  3. 3

    Явно укажите роль каждого референса в промпте.

  4. 4

    Настройте результат и сравните его с добавленными источниками.

Параметры

Промпт

Обязательно

Текстовое описание желаемой сцены, движения и действия.

Разрешение

Необязательно

Разрешение выходного видео. Этот уровень не поддерживает 1080p.

  • 480p

  • 720p

Длительность

Необязательно

Длительность сгенерированного видео в секундах.

Соотношение сторон

Необязательно

Соотношение сторон результата. Auto позволяет модели определить его по добавленным кадрам.

  • 21:9

  • 16:9

  • 4:3

  • 1:1

  • 3:4

  • 9:16

  • Авто

Референсные изображения

Необязательно

Одно или два изображения могут задать первый и последний кадры; более крупные наборы изображений используются для мультимодального управления.

Референсные видео

Необязательно

Необязательные референсы движения или стиля для мультимодального управления.

Референсное аудио

Необязательно

Необязательные аудиореференсы MP3 или WAV; для аудио требуется изображение или видео.