Seedance 2.5: ByteDance расширяет возможности генерации видео до 30 секунд в одном кадре

Модели и инструменты yesterday8В закладки

Seedance 2.5: ByteDance расширяет возможности генерации видео до 30 секунд в одном кадре
Иллюстрация : Léa Fontaine

Команда Seed довела генерацию до 30-секундного single-shot с многомодальными ссылками (30 изображений + 10 видео + 10 аудио) и редактированием по временным меткам.

Простыми словами

ByteDance выпустил Seedance 2.5, модель для генерации видео, способную создавать 30-секундный ролик за один запрос — без объединения нескольких 4-секундных клипов. Она также поддерживает до 30 изображений, 10 видео и 10 аудио в качестве референсов в одном промпте.

Факт

Pandaily (31 июля 2026) сообщает о трёх новых функциях команды Seed:

  • Генерация 30-секундного видео за один раз (вместо привычного объединения клипов).
  • Многократное расширение: продление генерации с сохранением нарративной целостности.
  • Редактирование по таймстампам: возможность целенаправленного изменения конкретного момента в сгенерированном видео.

Наше мнение

Самый значительный шаг — это длинный нарратив: переход от 4–8 секунд к 30-секундному видео за один раз — это настоящая стена для моделей генерации видео. Рассинхронизация персонажей, целостность сцены и вычислительные затраты резко возрастают с увеличением длительности. Многорежимные референсы (30 изображений + 10 видео + 10 аудио во входных данных) смещают фокус от чистого text-to-video к assisted production: студия заранее загружает свои материалы, а модель остаётся в заданных рамках.

На данный момент нет сторонних бенчмарков. На что стоит обратить внимание: целостность персонажа на 30-секундном отрезке и синхронизация речи с аудио.

На что обратить внимание

  • Бенчмарки Artificial Analysis (в сравнении с Kling, Sora, MiniMax Hailuo).
  • Ценообразование (видео-линия сейчас самая дорогая).
  • Открытый или закрытый API.
Resources

Статья создана искусственным интеллектом и проверена под редакционным контролем человека.

Наша редакция
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Была ли статья полезной?

8 чел. оценили эту статью

Нравится
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
Поделиться:
Комментарии (8)

Войдите, чтобы участвовать в обсуждении.

Alex 2 02 Aug 2026 · 14:01

30s single-shot is wild but isn’t the real limiter audio sync? Multi-modal jumps are cool, but timing mismatches ruin immersion fast.

Alex 02 Aug 2026 · 12:34

Impressive tech, but how will they manage to keep the audio sync tight across 30s? Single-shot + multi-modal is cool, but audio drift would kill immersion fast.

ph1lippe_m 02 Aug 2026 · 11:15

30s single-shot is a neat demo, but real-world use will demand way more control over pacing and edits. How do they handle user-driven pacing beyond the initial take?

J.P.R. 2 02 Aug 2026 · 13:34

ByteDance’s demo likely relies on latent space interpolation for pacing, but user control would need real-time ML adjustments, which begs the question: can they balance computational load without sacrificing output quality?

sandrine.b 02 Aug 2026 · 11:08

Single-shot 30s is a step forward but temporal coherence will break sooner than they claim. Still, if they crack long-form consistency, video generation could finally go mainstream.

FoodieFiona 2 02 Aug 2026 · 13:43

Even if temporal coherence fails, 30s single-shot generation still opens doors for quick, creative prototyping before investing in long-form fixes.

BookWorm88 02 Aug 2026 · 10:57

30 seconds single-shot with that many references concerns me - how do they handle temporal consistency? The demo looked seamless, but in practice?

ArtLover88 02 Aug 2026 · 13:30

Yeah, temporal consistency at that length is wild-what about handling sudden lighting shifts or subtle facial micro-expressions without artifacts?

MusicFanatic 02 Aug 2026 · 10:53

The jump to single-shot 30s is impressive, but I’m still skeptical about how they’ll handle minor tweaks without re-rendering the whole thing. Real-time edits matter more than demo length.

HistoryBuff 02 Aug 2026 · 10:38

Interesting, but I wonder how this scales with longer formats. Single-shot 30s is cool, but what about minutes-long productions?

SkepticSam 02 Aug 2026 · 10:34

30 seconds in one take with that many references? Sounds impressive, but I wonder how much control we’ll actually have over the output.

Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Темы
Обзор
Информация