6%

18 августа 2026 г.Команда Pixyn

Seedance 2.5: три режима видео и где она ломается

Seedance 2.5 умеет три вещи: видео по тексту, оживление фото и генерацию по набору референсов. Разбираем все три режима, длительность до 30 секунд, расход токенов по секундам и обещанное 4K, которого нет.

#seedance#seedance 2.5#нейросеть для видео#генерация видео нейросетью#видео из фото

TL;DR. Seedance 2.5 — видеомодель ByteDance, вышла 31 июля 2026 года. Работает в трёх режимах: по тексту, по одному фото и по набору референсов, на которые в промпте ссылаются как @Image1, @Video1, @Audio1. Ролик — от 4 до 30 секунд одним планом, разрешение 480p, 720p или 1080p, звук генерируется вместе с картинкой и не влияет на расход. Цена считается посекундно: 4-секундный ролик в 480p — 64 токена, тридцать секунд в 720p — 1020. 4K, которое обещают половина обзоров, у модели нет.

Три режима, а не один

Из-за шумихи вокруг «пятидесяти референсов» половина текстов про 2.5 описывает только третий режим. Режимов три, и первые два закрывают большинство задач.

Режим Что подаёте Когда брать
По тексту только промпт идея есть, исходников нет
По фото одно изображение + промпт оживить конкретный кадр, товар, портрет
По референсам до 50 файлов: картинки, видео, аудио нужен контроль над персонажем, стилем, движением и звуком

В студии это переключатель «Тип нейросети» (Text2Video / Image2Video) и выбор поколения — режим по референсам вынесен отдельной строкой Seedance 2.5 Reference. Настройки у всех трёх одинаковые: длительность, разрешение, соотношение сторон, звук, битрейт.

Что изменилось против 2.0

Seedance 2.0 Seedance 2.5
Длительность одним проходом 4–15 секунд 4–30 секунд
Референсов до 12 до 50 (30 картинок, 10 видео, 10 аудио)
Быстрый и дешёвый тир есть: Fast и Mini нет

Последняя строка важнее, чем кажется. У 2.0 есть облегчённые версии для черновиков, у 2.5 — нет: любая попытка стоит полную цену. Поэтому перебирать идеи на 2.5 — дорого, для этого остаётся Seedance 2.0 Mini.

ByteDance заявляет ещё «на 20% лучше следование промпту», но методику сравнения не публикует — проверить это утверждение нельзя.

Мультиреференс: файлы адресуются номерами

Каждый загруженный файл получает номер, и в промпте вы ссылаетесь на него напрямую. Это и есть смысл третьего режима: описать словами конкретное лицо невозможно, а показать картинкой — легко.

Персонаж с @Image1 идёт по улице из @Image2.
Камера едет следом, средний план, вечерний свет.
Характер движения — как в @Video1, ритм под @Audio1.

Так не стоит: «сделай видео с человеком с первой картинки в стиле второй».

Модель не сопоставит «первую картинку» с файлом сама. Без токена @Image1 референсы остаются просто вложениями, генерация идёт по тексту промпта: ролик вы получите, токены спишутся, а сходства с вашим исходником не будет.

Разделение труда простое: референс отвечает на вопрос «кто и что», промпт — «что происходит».

Показывать референсом Описывать словами
лицо, фигуру, одежду персонажа что персонаж делает
конкретный предмет, упаковку, логотип как движется камера
стиль и цветовую гамму откуда падает свет
характер движения (из видео) смену состояния в кадре

Сколько уходит токенов

Расход считается за каждую секунду ролика, и разрешение добавляет свою надбавку к секунде. Отсюда правило: длительность — самая дорогая настройка, а не качество.

Длительность 480p 720p 1080p
4 секунды 64 токена 136 324
5 секунд 80 170 405
10 секунд 160 340 810
30 секунд 480 1020 2430

Логика простая: секунда в 480p стоит 16 токенов, в 720p — 34, в 1080p — 81. Цена растёт пропорционально длине, никаких порогов и скидок за объём нет. Минимальный ролик — 4 секунды, короче модель не делает. Смета пересчитывается сразу, как только вы двигаете ползунок длительности или меняете разрешение, и всегда видна до запуска — сверяйтесь с ней, а не с этой таблицей: цены в группах моделей мы пересматриваем. Что такое токены и как они списываются — на странице тарифов.

Важное про режим по референсам. Если вы подаёте на вход видео, платить придётся и за него: ByteDance тарифицирует сумму секунд входа и выхода, и мы считаем так же. Пятисекундный ролик с пятисекундным видео-референсом обойдётся вдвое дороже такого же ролика без референса. Картинки и аудио на входе так не тарифицируются — только видео. Итог всегда виден на кнопке до запуска.

Звук — исключение: тумблер «Аудио» расход не меняет, звуковая дорожка рождается в том же проходе, что и картинка.

Про 4K, которого нет

Это главная ошибка, которая кочует по русскоязычным обзорам. Разбираем по первоисточникам:

  • на официальной странице модели у ByteDance 4K не упоминается вообще;
  • 17 августа 2026 года китайская пресса подала нативный 1080p как новую возможность — если бы 4K уже работал, добавление 1080p не было бы новостью;
  • в интерфейсе доступны 480p, 720p и 1080p.

Откуда взялось «4K»: анонс на конференции в июне пересказывали в прессе вперемешку с характеристиками версии 2.0. Нужен настоящий 4K — снимайте в 720p или 1080p и прогоняйте через апскейл видео отдельным шагом.

Сколько ждать результат

Генерация видео — не мгновенная операция, и это стоит закладывать в план работы. По нашим прод-данным: 4-секундный ролик в 480p по тексту считался 60 секунд; ролики на 5–8 секунд из фото — от 3 до 7 минут. Файл на выходе — 854×480 при 24 кадрах в секунду для 480p; если тумблер звука выключен, звуковой дорожки в файле не будет вовсе.

Разброс большой и зависит от очереди у провайдера, поэтому «прогоню десять вариантов за обед» — плохой план. Лучше один продуманный промпт и один прогон.

Чего Seedance 2.5 не умеет

Чтобы не потратить впустую:

  • Повторить кадр «след в след» — фиксации seed у модели нет. Два запуска с одним промптом и теми же референсами дадут похожие, но разные ролики. Серию кадр-в-кадр не соберёте.
  • Смонтировать сюжет со сменой сцен — это один непрерывный план, а не монтаж. Нужен ролик из эпизодов — генерируйте частями и склеивайте в редакторе.
  • Написать текст в кадре — надписи нестабильны у всего класса видеомоделей, 2.5 не исключение. Титры накладывайте в редакторе.
  • Сделать говорящего персонажа с точной артикуляцией — для липсинка есть отдельный класс моделей.
  • Показать себя в независимых тестах — на конец августа 2026 версии 2.5 нет ни в одном публичном рейтинге. Предшественница 2.0 занимает первое место в рейтинге image-to-video Artificial Analysis, но переносить это на 2.5 — домысел.

Когда не брать 2.5 и что взять вместо

  • Оживить одно фото товара или портрет — Seedance 2.0 Mini дешевле в разы, а результат на простом движении сопоставим.
  • Перебрать десять идей — берите Fast или Mini: у 2.5 черновиков нет, каждая попытка полноценная.
  • Нужен звук и разговор в кадре — посмотрите на Gemini Omni Flash, у него другой профиль сильных сторон.
  • Ролик длиннее 30 секунд — собирается только склейкой частей, одной генерацией эту задачу не закрыть.

Порядок, который экономит токены

  1. Соберите референсы заранее и посмотрите на них глазами: мелкое или размытое лицо на входе даст такое же на выходе.
  2. Первый прогон — 4 секунды и 480p. Задача дубля не красота, а проверка: те ли объекты подхватились по токенам @Image1.
  3. Убедились, что референсы читаются — поднимайте разрешение. Платить за 720p до проверки смысла нет.
  4. Длительность увеличивайте последней. Ошибка композиции на тридцати секундах стоит в семь с половиной раз дороже, чем на четырёх.
  5. Не просите в четырёхсекундном ролике два действия сразу. Наезд камеры плюс разворот персонажа не помещаются: к третьей секунде герой уезжает за край кадра. Одно действие на один ролик.

FAQ

Сколько референсов принимает режим Reference? До 50 файлов: 30 изображений, 10 видео и 10 аудио. В интерфейсе счётчик вложений показывает, сколько уже прикреплено.

Звук генерируется вместе с видео? Да, тумблером «Аудио» — картинка и звук считаются в одном проходе, расход токенов от этого не растёт. Если подаёте своё аудио референсом, движение подстраивается под него.

Почему цена меняется, когда я двигаю ползунок длительности? Потому что расход считается за секунды: каждая добавленная секунда прибавляет к смете, а разрешение поднимает цену самой секунды. Итог всегда виден на кнопке до запуска.

Можно ли получить 1080p? В интерфейсе такой вариант есть. Но потолок самой модели — 720p с нативным 1080p, добавленным в августе; всё, что выше, — это уже апскейл отдельным шагом.

Работает ли из России? Да, через студию Pixyn — без VPN и без зарубежной карты. Как устроен доступ к зарубежным моделям из России, разбирали отдельно.

Чем 2.5 отличается от 2.0 одним предложением? Вдвое длиннее ролик и вчетверо больше референсов, но нет дешёвого тира — за это вы и доплачиваете.


Собрать первый ролик можно в видео-студии: выбираете Seedance в списке нейромоделей, поколение 2.5, ставите 4 секунды и смотрите на смету перед запуском. Полное описание семейства — в карточке Seedance. Нет аккаунта — создайте: стартовых токенов хватит на пробную картинку, для видео понадобится пополнение.

Читать дальше

Попробуйте Pixyn бесплатно

Бесплатный старт и пробный Premium на 3 дня без привязки карты.

Начать бесплатно