Какую версию выбрать под задачу
Краткие рекомендации собраны в таблице, обоснование — в следующих разделах.
| Задача | Версия | Почему |
|---|---|---|
| Сцена длиннее 15 секунд без монтажной склейки | 2.5 | Единственная модель с такой длительностью среди доступных |
| История с завязкой и развязкой внутри одного кадра | 2.5 | Модель выстраивает несколько связанных планов, а не растягивает один |
| Серия роликов с одним и тем же героем | 2.5 | До 30 фотографий персонажа на входе против 9 у версии 2.0 |
| Вертикальный ролик для ленты соцсети | 2.5 | На телефоне разница между 720p и 1080p почти не видна |
| Крупный план лица или мелкий текст в кадре | 2.0 | 1080p сохраняет детали, которые в 720p смазываются |
| Горизонтальное видео для большого экрана | 2.0 | Разрешение заметно там, где картинку растягивают |
| Ролик до 15 секунд с максимальным качеством | 2.0 | Длительности хватает, а картинка чётче |
Что ByteDance заявила в релизе
Seedance 2.5 вышла 31 июля 2026 года. В официальном релизе ByteDance объясняет, зачем понадобилась новая версия: после выхода Seedance 2.0 компания заметила, что пользователям нужен уже не отдельный клип, а законченная работа. Отсюда 3 направления, вокруг которых собрана модель.
| Направление | Что заявлено | Что доступно в Нейрочате |
|---|---|---|
| Длинная история | 30 секунд за один проход плюс многократные продления до нескольких минут | 30 секунд за одну генерацию, продления недоступны |
| Мультимодальные референсы | До 30 изображений, 10 видеоклипов и 10 аудиоклипов за один проход | До 30 изображений, аудио и видео суммарно до 15 секунд |
| Точное редактирование | Управление по таймкодам, хромакей, смена ракурса, правка готового ролика | Управление по таймкодам через промпт |
Отдельно ByteDance называет слабые места модели: физическая достоверность сложных движений и стабильность сцен, где взаимодействуют несколько персонажей. Для разработчика это редкая честность, и она полезна на практике: сложную хореографию и групповые сцены стоит проверять внимательнее остального.
30 секунд — это про структуру, а не про длину
Главное, что теряется в пересказах: удвоение длительности сделано ради повествования, а не ради самой длительности.
ByteDance описывает это прямо: внутри 30 секунд модель выстраивает несколько логически связанных планов, так что история разворачивается через завязку, развитие, поворот и развязку, а не просто растягивает один момент. В примере из релиза — сцена с певицей: гримёрка, разговор с сотрудником, проход по закулисному коридору, встреча с танцовщицами и выход на сцену. Всё это одним непрерывным кадром.
Практический вывод для промпта: описывайте не картинку, а последовательность событий. Запрос «девушка поёт на сцене» даст 30 секунд статики. Запрос с движением камеры, сменой локаций и действиями персонажа даст то, ради чего эта длительность и нужна.
Стабильность героя как условие длинной сцены
Чем длиннее ролик, тем сильнее «плывёт» внешность персонажа: к 15-й секунде лицо уже отличается от того, что было в первом кадре. Спасают фотографии на входе — чем их больше, тем устойчивее модель держит образ.
Рост с 9 до 30 понадобился именно из-за удвоения длительности. Без него 30-секундный ролик с человеком в кадре не имел бы смысла: зритель увидел бы, как герой постепенно превращается в другого. Поэтому длительность и референсы работают в связке.
Управление сценой по таймкодам
Приём из релиза, которого нет в русскоязычных разборах: в промпте можно расписать, что происходит в конкретные секунды ролика.
В примерах ByteDance промпт выглядит так: «0–5 с: крупный план героя, камера медленно обходит его и переходит на средний план. 6–10 с: камера описывает круг вокруг второго персонажа. 11–20 с: в кадр входит третий, камера отъезжает до общего плана».
Вместе с метками изображений это превращает промпт в раскадровку: у каждого героя свой адрес вида [Image1], у каждого действия — своя секунда. На 30 секундах, где в кадре может быть несколько персонажей и смена планов, без такой разметки результат становится лотереей.
Где разрешения 720p достаточно
Разрешение — единственное, в чём версия 2.5 уступает предыдущей. Разберём, в каких сценариях это не мешает.
Что происходит с роликом после загрузки на площадку
Соцсети пережимают загруженное видео своим кодеком, и исходное качество до зрителя доходит не полностью. К этому добавляется размер экрана: вертикальный ролик человек смотрит на телефоне, где разница между 720p и 1080p физически почти не читается.
Разрешение становится заметным в трёх случаях: горизонтальное видео на большом экране, крупный план лица и мелкий текст в кадре. Общие и средние планы, движение, смена сцен в 720p выглядят нормально.
Сериальный контент с постоянным героем
Аналитики соцсетей отмечают среди трендов 2026 года сериализованный контент: повторяющиеся образы, узнаваемые персонажи и сюжетные линии, которые тянутся из ролика в ролик. Аудитория возвращается не за отдельным видео, а за продолжением.
Для такого формата стабильность внешности важнее разрешения. Если в десятом ролике герой выглядит иначе, чем в первом, серия рассыпается — и никакие 1080p этого не исправят. 30 референсов решают ровно эту задачу.
Длительность, которая попадает в рабочую вилку
По данным одного из агентств, замерявшего 380 роликов своих клиентов, оптимальная длина видео в TikTok в 2026 году составляет 21–34 секунды для нового аккаунта и 45–90 секунд для зрелого. Там же отмечают, что у по-настоящему виральных роликов длина перестаёт влиять на охват: были и 17 секунд, и 3 минуты.
30 секунд попадают в верхнюю границу вилки для нового аккаунта. То есть версия 2.5 закрывает целиком тот формат, который раньше приходилось собирать из двух генераций.
Конкретные форматы, где 30 секунд работают лучше 15
- Демонстрация процесса. Товар в использовании, приготовление блюда, сборка — то, где действие нужно показать от начала до конца, а не намекнуть на него.
- Диалог или монолог героя. За 15 секунд человек успевает сказать одну фразу, за 30 — донести мысль целиком.
- Сцена с развитием. Завязка, поворот и финал внутри одного кадра, без монтажной склейки, которая выдаёт генерацию.
- Фоновое и зацикленное видео. Заставки, атмосферные вставки, видео для экрана в кафе или на стенде: чем длиннее петля, тем менее заметен повтор.
- Обучающий микроурок. Один короткий приём, показанный целиком, без обрыва на середине.
Когда нужна версия 2.0
Предыдущая версия не устарела и остаётся в интерфейсе не по инерции. Она лучше в трёх ситуациях.
Ролик пойдёт на большой экран. Презентация, сайт, монитор на стенде, горизонтальный формат для YouTube. Здесь картинку растягивают, и 720p начинает сыпаться.
В кадре крупный план или текст. Черты лица в среднем и крупном плане, надписи, мелкие детали товара — всё это первым страдает от снижения разрешения.
Длительности 15 секунд достаточно. Если сцена укладывается, брать более длинную модель незачем: качество будет выше, а расход токенов вдвое ниже.
Параметры и настройки генерации
| Параметр | Значение |
|---|---|
| Максимальная длительность | 30 секунд за одну генерацию |
| Продление готового ролика | Заявлено в релизе, в Нейрочате недоступно |
| Разрешение | 480p или 720p на выбор |
| Соотношение сторон | Настраивается, в том числе 9:16 под вертикальные форматы |
| Звук | Есть, плюс можно загрузить свой аудио-референс |
| Видео-референс | Есть — перенос движения и стиля с готового ролика |
| Первый и последний кадр | Поддерживается, но в отдельном режиме |
| Перенос персонажа по фото | До 30 изображений |
| Обращение к изображениям в промпте | Через метки [Image1], [Image2] |
| Длина аудио- и видео-референсов | Суммарно до 15 секунд |
Кадры и референсы — взаимоисключающие режимы
У модели 2 режима, и работать можно только в одном за раз. Разобраться с ними стоит до первой генерации.
- Кадры. Загружаете первый и последний кадр, модель строит переход между ними. Полный контроль над началом и концом сцены.
- Референсы. Загружаете изображения персонажа, аудио и видео для переноса движения. Контроль над стилем и героем, но не над конкретными крайними кадрами.
Совместить их не получится: если заданы первый и последний кадр, референсы персонажа в этой же генерации не подключить. Решать, что важнее — точные границы сцены или стабильная внешность героя, — нужно заранее.
Сколько стоят 30 секунд генерации
Интерфейс показывает расход до генерации. 30 секунд на Seedance 2.5 обходятся примерно в 3,94 млн нейротокенов, 10 секунд на Seedance 2.0 — примерно в 1,16 млн.
Выглядит как разница в 3,4 раза. Но считать нужно на секунду: около 131 тыс. токенов у новой версии против 116 тыс. у предыдущей. Разница примерно 13% — столько стоит сама модель, независимо от длительности ролика.
30 секунд стоят дорого именно из-за длительности, а не из-за модели. Если сцена укладывается в 15 секунд, расход снижается вдвое, а разрешение вырастает до 1080p.
Откуда взялись 4K и 50 референсов
Обе цифры разошлись по публикациям, и ни одной из них нет в официальном релизе.
Про 50 референсов. ByteDance называет другие числа: до 30 изображений, 10 видеоклипов и 10 аудиоклипов за один проход. Похоже, в пересказах их просто сложили: 30 плюс 10 плюс 10 действительно даёт 50. То есть расхождения между анонсом и интерфейсом нет — есть ошибка в цитировании. В Нейрочате доступны заявленные 30 изображений.
Про 4K. В релизе разрешение не упоминается ни разу. Компания подробно пишет про текстуры, кожу, свет и насыщенность, но конкретной цифры не даёт. Авторы, получившие тестовый доступ, отмечали это же: выходное разрешение ByteDance не публиковала. В Нейрочате модель работает в 480p или 720p.
Все 14 моделей: длительность и возможности
Всё, что доступно в Нейрочате, отсортировано по длительности.
| Модель | Длительность | Разрешение | Особенности |
|---|---|---|---|
| Seedance 2.5 | 30 с | 480p / 720p | Видео-референс, персонаж ×30, звук, крайние кадры |
| Seedance 2.0 | 15 с | 1080p | Видео-референс, персонаж ×9, звук, крайние кадры |
| Kling 3 | 15 с | 1080p | Раскадровка, звук, крайние кадры |
| HappyHorse 1.0 | 15 с | 1080p | Оживление фото |
| Sora 2 | 12 с | — | Оживление фото |
| Sora 2 Pro | 12 с | — | Оживление фото |
| Kling 2.6 Pro | 10 с | — | Оживление фото, звук |
| Kling 2.5 Turbo Pro | 10 с | — | Крайние кадры |
| Kling 2.1 Pro | 10 с | — | Крайние кадры |
| Kling 2.1 Master | 10 с | — | Оживление фото |
| Runway Gen-4.5 | 10 с | — | Оживление фото |
| Hailuo 2.3 | 10 с | 1080p | Оживление фото |
| Veo 3.1 | 8 с | 1080p | Крайние кадры, персонаж ×3, звук |
| Veo 3.1 Fast | 8 с | 1080p | Крайние кадры, звук |
Собранные в одну таблицу, модели показывают 3 закономерности: 30 секунд даёт только одна из них, видео-референс есть лишь у линейки Seedance, а раскадровка — только у Kling 3. Остальные возможности дублируются, и выбор внутри группы упирается во вкус и конкретный результат. Полное сравнение по режимам работы есть в обзоре видеомоделей.
6 замечаний из практики
1. Расписывайте промпт по секундам
Разметка вида «0–8 с… 9–18 с…» превращает генерацию в раскадровку и убирает случайность на длинной сцене.
2. Длинный ролик нужен реже, чем кажется
Прежде чем выбирать версию 2.5, проверьте, не укладывается ли сцена в 15 секунд. Тогда получите 1080p и вдвое меньший расход.
3. Референсы — с разных ракурсов
30 похожих фотографий работают хуже, чем 10 разных. Модели нужна информация о лице с разных сторон.
4. Соберите набор референсов один раз
Для серии роликов с одним героем набор фотографий готовится однократно и переиспользуется во всех генерациях.
5. Групповые сцены проверяйте внимательнее
ByteDance сама называет слабым местом стабильность сцен с несколькими взаимодействующими персонажами.
6. Сравнивайте на своей задаче
Один промпт в 2 моделях за пару минут скажет больше, чем любая таблица характеристик.
Соберите ролик от сценария до анимации
14 видеомоделей, генерация изображений и текстовые модели — в одном окне, без VPN.
▶ Попробовать бесплатноЧасто задаваемые вопросы
У версий разная специализация. Seedance 2.5 берёт длительностью и стабильностью персонажа: 30 секунд за одну генерацию против 15 и до 30 фотографий героя на входе против 9. Seedance 2.0 берёт качеством картинки: разрешение 1080p против 720p. Остальные возможности совпадают — обе принимают видео-референс, поддерживают первый и последний кадр и генерируют звук.
В Нейрочате нет: одна генерация выдаёт максимум 30 секунд. ByteDance заявляла режим многократных продлений, при котором к готовому ролику дописывается продолжение с сохранением героев и темпа, но в интерфейсе он пока недоступен. Материал длиннее 30 секунд собирается монтажом из отдельных генераций.
Нет. В официальном релизе ByteDance названы 30 изображений, 10 видеоклипов и 10 аудиоклипов за один проход, а разрешение не упоминается вообще. Цифра 50, скорее всего, появилась в пересказах как сумма 30 + 10 + 10, а 4K — из презентационных материалов, а не из характеристик. В Нейрочате доступны 480p и 720p и до 30 изображений персонажа.
Для вертикальных роликов на телефоне разница с 1080p почти не читается: экран физически меньше, а платформы всё равно пережимают загруженное видео своим кодеком. Разрешение становится заметным на большом экране, в горизонтальном формате и там, где в кадре мелкий текст или крупный план лица. Если ролик снимается под ленту, 720p обычно достаточно.
Через Нейрочат: русский интерфейс, оплата картой российского банка, без VPN и зарубежных аккаунтов. Seedance 2.5 доступна там вместе с 13 другими видеомоделями — Kling, Veo, Sora, Runway, Hailuo — а также с текстовыми и графическими моделями, так что сценарий, первый кадр и анимацию можно собрать в одном окне.