Флагманская модель ByteDance: длинные связные сцены до 30 секунд, огромный бюджет референсов и нативное стерео-аудио — всё за одну генерацию, без склейки.
Вдвое длиннее, чем у Seedance 2.0. Полноценный рекламный ролик или мини-история целиком, без склейки отдельных кусков и без рассинхрона персонажа между ними.
До 30 изображений, 10 видео (суммарно до 30 секунд) и 10 аудиодорожек в одном запросе. Каждому референсу можно назначить роль прямо в промпте: @image1 — лицо героя, @video1 — движение камеры.
Звуковые эффекты, музыка, диалоги и закадровый голос генерируются в том же проходе, что и картинка, — поэтому попадают в кадр по времени. Русский lip-sync работает хорошо.
Длинную сцену модель понимает лучше, если разбить её на окна времени: 0-3с, 3-8с, 8-14с. В каждом окне — своё действие и своё движение камеры. Это и есть монтаж внутри одной генерации.
Текст в видео, оживление первого кадра, переход между первым и последним кадром, только конечный кадр и мультиреференс. Режимы взаимоисключающие — выбирается один.
Формат файла выбирается в блоке «Дополнительно». MP4 играет везде, MOV удобнее забрать в монтаж — но в некоторых браузерах его придётся скачать, а не смотреть онлайн.
Без видео-референса стоимость считается просто: ставка за секунду × длительность вашего видео.
С видео-референсом ставка за секунду ниже, но умножается на сумму секунд: длительность загруженных видео + длительность результата. Поэтому короткие референсы выгоднее длинных.
Диапазон: от — кредитов (480p, 4 секунды) до — кредитов (1080p, 30 секунд).
Опишите сцену по формуле: субъект → действие → обстановка → визуальный стиль → работа камеры → звук. Модель читает промпт как режиссёрскую заявку, а не как художественный текст.
Для роликов от 8 секунд разбейте сцену на окна времени (0-3с, 3-8с, 8-14с) без пропусков и в каждом укажите движение камеры. Это удерживает темп и не даёт сцене расплыться.
Каждому референсу дайте явную роль: «@image1 задаёт лицо и причёску героя, фон оттуда не бери». Если несколько фото — это один объект с разных сторон, напишите об этом прямо.
Внутри одного окна используйте одно движение камеры. Комбинация «панорама + зум + наклон» одновременно даёт дёрганую картинку. Менять камеру между окнами — можно и нужно.
Формулируйте позитивно: «плавное стабильное движение, естественные пропорции» вместо «без тряски, без искажений». Отрицания модель не обрабатывает, отдельного negative prompt у неё нет.
Главное — длительность: 2.5 генерирует до 30 секунд против 15 у версии 2.0. Второе — бюджет референсов: 30 изображений, 10 видео и 10 аудио вместо 9 + 3 + 3. Плюс выбор формата файла (MP4 или MOV) и заметно более сильное следование сложным многошотовым промптам. Версия 2.5 дороже — если нужен короткий одиночный план, версия 2.0 обойдётся дешевле.
Цена считается за секунду и зависит от разрешения. Минимум — 480p на 4 секунды, максимум — 1080p на 30 секунд. Если вы загружаете видео-референсы, ставка за секунду ниже, но умножается на сумму «секунды референсов + секунды результата». Точные значения — в таблице выше, они обновляются автоматически.
Да. Диалоги и закадровый голос на русском работают хорошо — реплики можно писать прямо по-русски. Также поддерживаются английский, китайский, японский, корейский, испанский, индонезийский и португальский. Звук генерируется в одном проходе с картинкой, поэтому попадает в губы и в действие.
16:9, 9:16, 1:1, 4:3, 3:4, 21:9 и режим «Авто», в котором модель сама подбирает соотношение сторон под содержимое сцены. «Авто» стоит по умолчанию и обычно даёт лучший результат при работе с референсами.
Нет. Три сценария взаимоисключающие: оживление первого кадра (и, при желании, последнего), мультиреференс по изображениям и мультиреференс по видео. Аудиореференсы можно добавлять к мультиреференсным режимам. Форма сама подскажет, если комбинация недопустима.
MOV — контейнер QuickTime, его удобнее забирать в профессиональный монтаж. Для просмотра в браузере и публикации в соцсетях лучше MP4: он играет везде. Если сомневаетесь — оставьте MP4, он стоит по умолчанию.
Это отдельная кнопка в форме: вы описываете идею, ИИ-режиссёр разбивает её на кадры и рисует одну картинку-сетку со всеми планами, а затем Seedance 2.5 оживляет эту сетку в связную сцену с переходами между шотами. Удобно для нарратива из нескольких планов и для превиза.
Опишите идею — ИИ доведёт промпт до режиссёрской заявки, а Seedance 2.5 снимет сцену со звуком. От — кредитов.
Мы используем cookies для работы сервиса, сохранения сеанса и обезличенной статистики. Подробнее в Политике конфиденциальности.