Seedance 2.0: ИИ от ByteDance, который сам снимает и монтирует кино, напугал киноиндустрию
Официальный анонс Seedance 2.0 показал, что это качественный скачок в генеративном видео. В основе модели лежит архитектура двойного диффузионного трансформера, которая одновременно синтезирует видео и аудиопоток. Однако главное ноу-хау - это функция "мультипланового повествования". Пользователь даёт один детальный текстовый промпт (например, "детектив преследует преступника по мокрым улицам ночного Шанхая, кульминация - драка на крыше небоскреба"), а ИИ разбивает его на логические сцены: общий план города, крупный план бегущих ног, диалог в переулке, финальную схватку.
Модель самостоятельно поддерживает консистентность ключевых элементов на всём протяжении: персонажи не меняют внешность и одежду, освещение и цветовая гамма соответствуют заданной атмосфере, а движения камеры (наезды, отъезды, смена ракурсов) выглядят осмысленными, как будто над видео работал оператор. Максимальная длина одного сгенерированного отрезка - 15 секунд в 2K-разрешении, но система может объединять их в практически бесконечные нарративные последовательности.
Тестировщики и блогеры, получившие ранний доступ, выделили несколько функций, которые вызвали наибольший резонанс:
- "Кинематографический клон": Загрузка скриншотов или короткого клипа из существующего фильма позволяет Seedance 2.0 проанализировать и воспроизвести его визуальный стиль, чтобы создать абсолютно новую, но стилистически идентичную сцену. Блогер Film Hurricane продемонстрировал это на кадрах из анимационного фильма, и подписчики не смогли отличить работу ИИ от оригинала.
- Глубокое перепрофилирование видео: Модель позволяет загрузить любой видеоклип и кардинально его изменить: заменить актёра, добавить или убрать объекты, поменять время суток, погоду или даже жанр (превратить драму в комедию).
- Полный аудиомонтаж: Система поддерживает 8 языков, включая русский и английский. Она может синхронизировать сгенерированное видео с загруженной аудиодорожкой или создать её с нуля: сгенерировать реалистичную речь по тексту, добавить фоновую музыку и звуковые эффекты, соответствующие действию на экране.
По прогнозам, первыми под удар попадут:
- Создатели короткометражного контента: рекламные ролики, клипы для соцсетей, инди-комиксы и анимационные сериалы. Seedance 2.0 может снизить стоимость и время их производства на порядок.
- Пре-продакшн: Генерация раскадровок, пилотных сцен и концепт-видео для презентаций инвесторам станет мгновенной.
- Пост-продакшн: Ряд задач монтажёров, колористов, специалистов по простому VFX и звукорежиссёров может быть автоматизирован.
Компании с огромными библиотеками контента (как сама ByteDance с Douyin/TikTok) получают двойное преимущество: они могут обучать модели на своем материале и первыми внедрять их в массовые креативные инструменты.
Однако в мейнстримной индустрии звучат тревожные ноты. Комментарии в духе "буквально каждая работа в киноиндустрии под угрозой" стали более частыми. Профессионалы опасаются сокращения рабочих мест и девальвации навыков. Пока "неприкосновенными" остаются сценаристы (ИИ-сюжеты оценивают как шаблонные) и топовые специалисты по сложным видам VFX и режиссуре актёрской игры, но технологический тренд очевиден. Что дальше?
На данный момент Seedance 2.0 доступна только в Китае в сервисе Dreamina. Официальный глобальный запуск запланирован на конец февраля 2026 года через популярные платформы ByteDance: CapCut, Higgsfield и Imagine.Art. Это не просто выход нового инструмента, а тест на готовность глобального творческого рынка к новой реальности, где "режиссёром" может стать любой человек с яркой идеей, а границы между профессиональным и любительским контентом окончательно растворятся.
Пока это на сколько? На месяц, пол года, год?
Вот оно как...а если через месяц появится инструмент который и эту проблему решает, который сам будет выбирать композицию, удачную анимацию и писать хорошие диалоги? Уже сейчас неуч и бездельник может промтом сгенерить видео которое введет в заблуждение обычного человека.
Киноиндустрия превратилась в это во первых из-за леваков пришедших к власти в множестве стран, во вторых она отупела из-за того, что кино-бизнес снимает то, что жрут массы, поэтому большинство это просто хрючево. Но нейронки никак не улучшат эту ситуацию, будет тоже самое, только больше.
4 года назад никто бы не поверил в то, что ролики выше вообще возможны как генеративный контент, большинство людей не смогли бы распознать там хоть что-то искусственное, а специалисты пожимали бы плечами и говорили, что сгенерировать такое невозможно. Что будет еще через 4 года?
Ну и надо понимать, что специалисты все таки пойдут гулять на улицу, как и многие другие. После прочтения статьи из журнала прямо неприятно становится за перспективы, хотя они были понятны.
https://render.ru/ru/yellow_river/post/27751
И это так не работает потому что промпт "Не жми красную кнопку" - все еще содержит токен "жми красную кнопку"
Нейросети не могут выйти за пределы обучающей выборке. Да возможножно мы с ней не знакомы - но через некотрое время от однообразия ИИшки мы начнем замечать одинаковость.
Это все тот же дипфейк что существует с середины 2010х Просто раньше меняли только лицо актера, то щас все тело и часть поведения.
Сначала юзер будет тыкать на кнопку "refresh" до посинения, потом догадается, что надо спросить у LLM, как ему сформулировать запрос, чтобы в ответе было меньше шаблонов и попросит накидать уточняющих вопросов для лучшего понимания. Кстати, негативный промпт, как правило, работает безупречно, нейронки уже не настолько тупые.
Проблема в другом. Генераторы видео появляются позже, чем инструкции по их использованию попадают в веса LLM. Да, можно включать функцию поиска, но окно контекста не заменит веса, результат будет заметно хуже. Например GPT5 еще не знает про Sora2.
всё верно
нейросеть это тулзбез специалиста
толку мало
Цыпцын в 2019 на CG Event помнится говорил что пора задуматься чем вы все присутствующие будете заниматься в будущем, т.к. скорее всего вас просто заменят нейронными сетями.
Вопрос перераспределения ренты не из добрых побуждений, а вынужденная мера. Деньги, золото и большой дворец с охраной особо не спасут. Если по улицам будут ходить толпы безработных, то они спокойно могут заблокировать административные и промышленные объекты (водоотведение, энергетика) и выдвинуть политический ультиматум. В экономическом плане ничего не хотят менять. Старых людей будет становиться все больше и безработных тоже. Повышать пенс. возраст и налоги бесконечно не получится и на все это накладывается 4-й пром. переход, когда ИИ вытесняет людей и они больше не нужны в таких количествах.
Grok лучше всех пишет сценарии, не по шаблонам. Определенно самая креативная LLM, умеет в юмор и стабильный диегезис.
Clode самый сильный в поэзии. Над задачей думает значительно дольше обычного и результат на голову выше остальных.
GPT5.3 внезапно вырвался в кодинге, рвет по всем параметрам предыдущего, хотя казалось бы...
Gemini 3 Flash лучше всех описывает изображения, NanoBanana Pro практически идеально генерит и редактирует хайрез.
Deepseek, QWEN, YandexGPT чуть хуже, но бесплатные. Со временем граница размоется ибо "закон убывающей отдачи".
По-моему, при существовании подобных возможностей, как сейчас ииндустриет, человеческой личности должно быть интересно, а что она сама может придумать и какой процесс творческий для себя организовать, чтобы это имело ценность для окружающих и себя. Представляется реклама кино: у нас настоящие операторы, в съёмке использовался кран, плёнка, наложенная на матрицу художниками, и т.п.Смысл нейросетей таких, в том что появился инструмент с помощью которого можно быстрее повлиять на сознание человека, не вкладываясь в создание больших команд для таких процессов. Это просто экономически выгодно. Машинка сгенерированная нейросетью будет такой же как и та, что снята камеру. Разницы никакой. А вот процесс создания будет отличаться. Процесс проживания.
— Привет! у тебя настоящее или цифровое? Не! цифровое не интересно.. А как докажешь, что настоящее?
С качеством, в контексте генеративного ИИ, неоднозначно. С одной стороны, оно должно падать, поскольку низкий порог вхождения и низкая цена вопроса неизбежно мотивируют к созданию и публикации всякой ерунды. Кроме того, есть ещё один важный фактор ухудшения качества, который касается уже индустрии - конкуренция жадностей. С другой стороны, если ИИ будут развиваться, то возможно, что даже на самый тупой промпт ИИ будет создавать что-то адекватное. Хотя, скорее всего ИИ будет работать по принципу наибольшей эффективности, т.е. выдавать минимальное качество, при котором большинство пользователей не будет просить переделать.
PS: А с сюжетами есть одна небольшая проблема - исчерпание возможных комбинаций в конечном множестве. На первый взгляд, может показаться, что оно большое, но нет. Как пример - количество слов в языке гораздо меньше, чем количество всех возможных комбинаций букв в алфавите (особенно, если не учитывать сложные и прочие производные слова).
Например, хочу я написать сценарий боевичка. Я могу начать с "в конце взрывается вертолет", "главный герой - ветеран войны во Вьетнаме" и "главный герой отправляется зачищать базу вооруженных повстанцев".А что, уже вполне себе задумка вырисовывается,и что интересно за это уже собирали много денег, и люди там восхищались и смотрели по 10 раз )
А что еще интереснее, то любой творческий процесс работает таким-же образом. Ну не бывает людей, которые с первого раза без правок создают произведение искуства. Они так-же берут болванку и начинают обтесывать ее, детализировать. Это касается что дизайна (макеты), что живопись (эскизы, скетчи, подмалевки), что сюжета книги (наброски). На это уходит дофига времени умственного и физического труда. Это составляет именно тот момент, о котором говорят "создал в поте лица". Потому-что если бы этого этапа не было, все делали бы всю работу с первого раза, тратя время только на печать текста или намазывание краски кисточкой. Но нет. Так это не работает. Все ошибаются и ошибаются сотни раз, даже выполняя ОДНУ задачу.
И причем специалист от неспециалиста отличается тем, что неспециалист будет долго перебирать эти варианты, и скорее всего будет перебирать не совсем оптимальные варианты. А вот специалист при переборе отсеивает сразу большие куски, исходя из своего опыта и при переборе сразу видит наиболее перспективные варианты в пространстве выбора. И все. И второй всю жизнь учится только этому, только отсеву вариантов. Это назвается "вкус", "стиль", "уровень", "качество" и прочее. Потому-что буквы и слова (или пиксели) что для первого, что для второго вообще абсолютно одинаковые.
Специалисты по эффектам, графике, конечно же пойдут на улицу. Но вот сценаристы будут подольше востребованы, пока не появится полноценный ИИ. Шаблонность в сценариях пока непреодолима с помощью современных текстовых моделей. Но, реклама, например, на 99% вполне себе шаблонная. Так что да, проблему сложно переоценить.
Заблуждение. Не обязательно нужно понимание специалиста, вполне хватит насмотренности зрителя. Зритель ходит в кино и редко ошибается, когда ему в кино преподносят некрасивую картинку. Как правило видит, где хорошо, а где плохо.
И здесь будет все решать насмотренность зрителя. Из нескольких вариантов он выберет тот, которые посчитает классным, не оперируя низкоуровневыми свойствами, такими как композиция и т.п.
Так что дело остается только за хорошим сценарием, вот здесь пока еще проблема.
Да, но тут уже 300 раз говорили, что речь и не идет о полной замене. А о том, что 90% человек будут не нужны, как раз те люди, которые делали ту часть работы, которую теперь можно делать с помощью нейронки.
Да, зритель «видит», где красиво, хотя "красиво", есть понятие субъективное. Но чтобы сделать «нормально», нужно понимание, почему этот кадр работает, а другой — нет.
«Зритель редко ошибается» — ага, особенно когда лайкает "эффектный" нейрослоп. Именно поэтому ютуб забит говном, а не шедеврами. Потому что «нравится» ≠ «хорошо сделано». И да, можно сгенерировать 500 вариантов и выбрать «тот самый», но это не творчество, а лотерея для бездельников и неучей. Давайте тогда, доверим архитектуру «насмотренному зрителю», который много раз бывал в городе, а не проф. архитектору. Зритель же «видит», где красиво!
Сложно спорить, если человек не последователен в своей же логике.
Я нигде не утверждаю, что все это позитивно, и что «нравится» = «хорошо сделано».
Просто это работает, и это факт: насмотренности зрителя хватает, чтобы сделать говно, которое забракует специалист, но которое зайдет массовому зрителю. А на массового зрителя все и рассчитано.
И архитектуру бы доверили кому угодно, вот только там недостаточно нравиться массовому зрителю, надо чтобы здание не рухнуло и не убило никого. А так, концепт-художники, которые работают с архитекторами, давно уже используют нейросети.
Фильм от насмотренного зрителя никого не убьет, зрителям нравится, значит задача выполненна, несмотря на мнение специалистов, а если появятся нейросети, которые гарантированно будут генерировать безопасные архитектурные проекты, то и города будут застроены такими зданиями.
Смешно. Делать больше нечего продюсерам, когда можно будет реализовать все в нейронке.
Многие студии уже как года 2 генерируют ассеты для композа на собственных нейронках. Причем качество не хуже, чем у Weta. ИИ сделает 90+% специалистов ненужными. Некоторые ИИ уже сейчас позволяют менять ракурс, настройки камеры, освещение объекта и сцены в целом через интерфейс. Через лет 5 высококлассные фильмы можно будет создавать вообще без художников по спецэффектам, колористов, актеров, 3D моделлеров, операторов и т.д. Раскадровка, персонажи, объекты, освещение, настройки камеры, линзовые эффекты - все это будет зашито в единый удобный интерфейс. Останутся только супервайзеры-композеры и режиссеры-сценаристы. То, что раньше делала сотня человек, будет делать десяток.
Но вот какие-то частные задачи - такое да, такое можно решать на СВОИХ нейронках, запиленный на совершенно конкретную функцию. Ну например, перенос лица по рефу на отснятый с другим актером материал, удаление фона и прочие штучки, которые напоминают продвинутые эффекты для видеоредакторов, управляемые не масками а промтом и набором спецнастроек. Такое да, такое можно делать. Но это не полный цикл, и никогда им не станет, это чуть более допиленный набор инструментов для того чтобы закрывать какие-то определенные задачи.
Что касается того что "останутся режиссеры-сценаристы" - нет, не останутся. Их постигнет судба копирайтеров, потому-что уже нейронка способна неплохой сценарий создать. Говорю как ведущий настольных ролевых игр, в последние полтора года мои сценарии генерируются на 90% нейронкой. Я только задаю стиль, сеттинг, указываю желаемые моменты и все. Последние нейронки генерируют просто отпадные сюжеты, с возможностью править все "онлайн" типа "вот тут поправь, побольше брутальности".
Только нужно просить генерировать не сразу ВСЕ. А создать идею, раскидать на сцены, определить персонажей, характеры и уже потом скормить это все в следующую иттерацию для прописывания деталей. Допишите набор правил, оно и подскажет как и где правильно сцену поставить, что выделить, где надо акцентики расставить, даже мелкие ньюансы характера и внешнего вида пропишет. С какого ракурса снять и т.п. Это просто манипуляция с данными. Со словами играть на несколько порядков проще чем с пикселями, хотя-бы из-за объема данных.
Насчет "композеров" - тоже не останутся, современные видеонейронки имеют внутри систему слоев типа Qwen Layers, они уже нативно работаю со слоями, и там есть возможность теоретически править ЛЮБОЙ слой. Просто это происходит под капотом, автоматически. И тут тоже нет никакой непосильной сложности. Может же один композер или режиссер другого обучить? Может. Нейронку тоже смогут.
Пока такого качества все равно нет, в 4К не генерируют, 8 битный цвет и т.п., т.е. не продакшен качество. Плюс, полного контроля нет. Плюс для кино конечно желательно, чтобы были реальные актеры, на них ведь люди идут. Поэтому идеально именно для чернового монтажа.
Я неправильно выразился. Студии обучают сторонние модели (платные/бесплатные) на своем высококачественном контенте через кастомные ноды. Работа осуществляется через оболочку Comfy и т.д.
Такое да, такое практикуется. Но все-же это процесс больше напоминает обучение лоров (LORA), которые часто мерджатся с базовыми моделями создавая "новую" модель. Но там все-таки немного другой принцип. Это подходит для каких-то деталей, но конечно не может являтся самостоятельной моделью. По вышеуказанным мной причинам, все-же затраты ресурсов непропорциональны. Это часто применяется для создания "концептов" но не более того. Мы не можем тут говорить о "полноценной видеонейронке которая выполняет ключевую работу". Совершенно разные масштабы
Ну я гененироую и фото и видео локально и получается не хуже. Да, там монтаж надо делать самому, и липсинг. Но, локальные решения хоть чуть отстают, но тоже развиваются, с опозданием на полгода-год. Уровень Seedance 2 будет локально через полгода-год, может раньше. Технология известна и ничего космического в ней нет, поэтому неизбежно будут развиваться локальные решения, и они и не позволят онлайн-сервисам сильно взвинчивать цены.
Да, онлайн всегда будет дороже, но это справедливая плата за экономие времени и отсутствие необходимости покупать недешевое железо. И всегда будет баланс, стоимость онлайн не вырастет настолько, чтобы было сильно выгоднее генерировать локально.
Я заменил Kling на Wan 2.2, если подходить с умом, то получается не хуже. По причине, что Kling и прочие не хотят делать безлимитку. Я готов платить за качественный результат, это справедливо. Но не хочу платить деньги за бракованные генерации, которые не соответствуют промтам, например с поплывшим лицом или тремя руками. Если сервис не может гарантировать продукт, соответствующий запросу, то почему я должен за него платить? В магазине я не буду платить за гнилые апельсины, то почему я здесь это должен сделать? Мне не нужен бракованный результат, даже за бесплатно. Если не можете результат гарантировать, то надо сделать подписочную систему, тогда буду делать столько генераций, чтобы результат получился нормальным.
Это в ближайшем обозримом будущем. А глобально — доступность ИИ будет ограничена. Будет ситуация примерно как с ядерным оружием. От этого не уйти, потому что одна из основ материального существования нашей цивилизации — добавленная стоимость. Бесконтрольный рост вычислительных мощностей в конечном итоге уничтожит и основу, и цивилизацию
Отказ и ограничения кажутся утопией и сравнение с ЯО тоже сильно притянуто. Когда вышла MJ 4.0 у художников начались метания и выплески гнева, киношники злорадно потешались, будучи уверенными, что их это не коснется. Сейчас им время ныть и стонать.
Люди не понимают что им просто нечего будет предложить в качестве конкуренции, на какой бы то там ни было должности они не находились. Сейчас эта тема с курсами идет условно "научись работать с промтами и когда все будут без работы, ты будешь на коне!". Да, щас. Генерация промта под задачу как бы не проще чем генерация видео, скоро они будут и аналитику лучше делать (уже сейчас часто делают), и данные обрабатывать, и маркетинговые стратегии разрабатывать икомпаниями управлять, потому-что эти профессии имеют тоже дело с данными. Раз можно научить человека, можно научить нейронку. Причем намного быстрее и намного дешевле (если брать масштабирование, один раз научил, потом хоть миллион клонов делай таких-же хороших, уже забесплатно, только железо под них, которое тоже окупает затраты очень быстро). Одно дело платить топовому маркетологу 500к, условно, другое дело в 10 раз меньше, на токены. Причем за эти токены он гораздо больше сгерерирует результата количественно чем человек. Так что я думаю года через два потешатся будет особо некому...
Да я же не про художников и киношников. Их тысячная доля процента от населения Земли.
Взрывной рост вычислительных мощностей ломает принципы эволюции — вот о чём речь. Завтра связка квантовых компьютеров сломает биткойн, но это кажется чем-то неважным большинству из нас (жили как-то без него). А вот то, что уже сейчас AI-агенты ломают биржевую торговлю — это критично важно. Потому что рушится основа свободных экономических отношений и конкуренции.
Задумываются об этом пока совсем немногие, у кого есть доступ к большим данным и возможности влиять на глобальные процессы.И, кажется, им нечего предложить человечеству в ближайшем будущем, кроме запретов.
Эволюция цивилизации, в принципе, всегда ведёт её к гибели. С появлением ИИ этот процесс ускоряется в тысячи (миллионы, квинтиллионы и т.п.) раз.
На более мелком уровне мы видим толпы целователей задниц на немаленьких должностях. 20 летние блондинкис большими ... в качестве глав целых отделов и даже генералов ))) Безусловно "талантливые" родственники определяющие политику не только компаний но и государств. И вы еще про какую-то там конкуренцию? )) Конкуренция для ларьков и мелких шараг, и то не надолго, пока не решат налогами обобрать как липку.
Тоже попробую возразить. Про биржевую торговлю не буду, ибо не в теме. Единственно, что припоминаю - это высокочастотный трейдинг суперкомпьютерами, который практикуется десятки лет. Да, это не LLM, но большего там и не требуется. Нейросеть - это случайность вне рамок жестких алгоритмов, маклерам такой риск не нужен.
На личном опыте с появлением ИИ мало что изменилось. Вместо подбора спрайтов с людями и рисования теней я просто преобразую страшных NPC в качественную массовку, улучшаю другие визуально слабые части рендера. И как бы всё. Примерно тоже самое было и 2 года назад.
Тут вон чел свой CAD за пару выходных навайбкодил )) Так что инструменты ближайшего будущего будут генерироваться под задачу, использоваться и улетать в помойку, и это будет дешевле чем покупать лицензии на софт за деньги. Нужна своя фишка для того чтобы видеоданные ваши как-то обработало - не нужно ждать когда выпустят ленивые разработчики для этого инструменты, промт ввел, и готово. Будем видимо собирать себе по приколу кто 3ds max, кто blender, хотя, конечно, видимо это будет так, побаловаться, потому-что и редакторы особо не нужны. У нас на работе фотошопом перестали пользваться, тексты и картинки на маркетинговых материалах через нейронку уже правят, обленились...