OpenAI представила новую версию своего популярного инструмента для генерации видео — Sora 2. Эта инновационная модель знаменует значительный прогресс в области создания высококачественных цифровых фильмов и анимации благодаря своим выдающимся возможностям моделирования физического поведения объектов и окружения.
Sora 2 обеспечивает точную передачу динамики движений, взаимодействие объектов и способность реалистично отображать события, подчиняющиеся физическим законам реального мира. Если раньше подобные системы сталкивались с проблемами вроде необъяснимых телепортаций объектов или резких изменений формы тел, то теперь ситуация кардинально изменилась: мир, генерируемый Sora 2, выглядит естественно и предсказуемо, подобно реальности.
Помимо физической точности, новая модель успешно объединяет кадры с персонажами в разных стилистиках - от фотореализма до мультипликационного аниме-стиля. Кинематографичность изображений сочетается с созданием качественного звукового сопровождения, которое включает музыку, звуки окружающей среды и голоса героев. Благодаря этому Sora 2 идеально подходит для разработки короткометражных художественных произведений, рекламных материалов и развлекательного контента.
Еще одной интересной особенностью является инструмент "Cameo": используя всего лишь короткую запись лица и голоса, пользователи могут перенести себя или своих знакомых внутрь любых виртуальных миров, созданных моделью. Так создается уникальная возможность стать участником собственных историй или популярных сюжетов прямо в мобильном приложении Sora App.
Новая платформа обещает принципиально новый уровень интерактивности и творчества в сфере онлайн-развлечений. Открытая бета-версия доступна исключительно владельцам устройств Apple в некоторых странах, но ожидается расширение доступности для всех желающих.
Это достижение представляет серьезный прорыв в развитии технологий цифрового контента и демонстрирует значительные перспективы для дальнейшего развития сферы развлечений и коммуникаций.
Где все эти люди рвущие рупор, что никогда ИИ не будет генерить неотличимое от реальности видео?
Студии аниме и создатели нейроконтента (вот уж ирония) уже испугались.
За отдельную плату появится 30сек и FullHD. Сейчас 10 и 480р.
Эмм, может быть не стоит так открыто заявлять неспособности мыслить даже в краткосрочной перспективе? Даже в садике детей учат продолжать логическую цепочку:
ИИ не могла делать что-то -> очень быстро научилась
ИИ научилась, но имела ошибки -> очень быстро исправила их
ИИ исправила, но имела проблемы с динамикой/физикой -> очень быстро довела картинку до идеала
ИИ делает небольшие ролики -> ???????????????????????
Как ты думаешь, какие варианты кроме -> очень быстро научилась делать длинные видео?
Я подскажу, никаких!
Ну что вы как маленький, придираетесь. Отлично же знаете, что сейчас 5 секунд, а потом будет и 10 и 30 и так далее. Суть в появлении такого инструмента, который может полностью изменить весь подход к созданию видеоконтента.
А ИИ где? Зачем ты нейросети называешь ИИ?
Мне кажется проблема на другом конце. Инструмент даёт практически безграничные возможности за бесплатно. Бабки и пр. коты взлетают на лайках, остальное тонет.
Что проще, подстроится под рынок и вкусы аудитории или пытаться их менять? Выбор, в данном случае, очевиден.
Ну почему же, много хороших работ, просто бабок и котов делать проще, поэтому их и больше намного. Но конкретно вам же никто не запрещает сделать шедевр, вопрос лишь желания.
Вообще не важно, как это называется. Может в серверах Open AI гномы сидят, нам какая разница? Нам важны возможности инструмента.
И теперь складывается ощущение, что есть 2 реальности, причём в параллельной именно традиционные программы, а в настоящем - нейронки 😐
Для примера: поставил себе в телефончик новую игрушку от Гуглов - называется NotebookLM, так я офигел от результатов, настолько натуральные голоса (неотличимые от реальных) и настолько продвинутая логика. Кстати, смышлёный DeepSeek мне нравится больше, чем глуповатая Gemini 😄 Так что уже любой желающий может почувствовать сам, к чему всё идёт, при чём очень стремительно...
100 процентов!
А вы не смотрите все подряд. Я вообще поражаюсь. Люди заходят в рандомные ленты, которые изначально задумывались как источники жвачки для мозгов, и жалуются. Хотят чтобы им бесплатно показывали только снятые вживую ништяки. Опомнитесь. Идите в Третьяковку, не смотрите ленты с нейроконтентом. Так вы сидите, хотите просто мышку скролоить и хотите чтобы вам в рот только качественное клали. Это вообще где такое, в какой индустрии работает?
🤪
Странно, что люди продолжают задавать этот вопрос, при этом имея глаза и уши. Искусственный интеллект — это общий термин, охватывающий множество технологий, включая нейронные сети, машинное обучение, глубокое обучение и другие подходы. Нейросети — это подмножество ИИ, и в повседневной речи их часто называют ИИ для упрощения. Это как называть автомобиль "машиной" — технически неполно, но понятно всем.
Неспособность увидеть очевидную разницу между нейросетями и узкоспециализированным приложением индустрии CG очень о многом говорит. Очевидно, что у вас будет много вопросов и непонимания.
CG это ничтожно малый аспект нейросетей, просто ничтожно малый, многие рассуждая о нейросетях сводят их просто к генераторам картинок.
С другой стороны, ваше утверждение настолько очевидно, что не оставляет места для дискуссий.
У мальчика началась истерика, и запала клавиша CapsLock.
На чем основано данное утверждение, если даже в пресс-релизе нет ничего похожего? Вы владеете информацией, недоступной пресс-службе OpenAi, или работаете разработчиком у них? Или все-таки стоит воспринимать это утверждение, как фантазию или пожелание?
По другому это не продать.
Вместо этого, вы, как ребенок, не ответив по существу, написали фразу:
Ну будьте взрослее, ей богу.
На чем основано? На способности человека думать и анализировать опыт ближайших лет. Но ты не бери в голову, бесполезно.
Нет, сетку просто тренировали на подобном дерьме и она его легко воспроизводит, но косячит при других запросах. Это проблема всех нейросетей - они умеют только то, чему их обучили и на чем обучили. Шаг влево и все, ничего толкового не получается. Это только у Мятного Дворецкого уже ИИ шагает по планете, а в реальности электронный попугай.
Жить в придуманном мире и носить розовые очки никто не запрещает, но рано или поздно такие очки лопнут стеклами вовнутрь. Тем временем Майкрософт открыто говорит, что 30% кода у нее пишет ИИ и сокращает людей тысячами (с начала года 15 000 человек).
Таких что-ли?)
Решил отказать от собственных слов про "ИИ"?
Ты даже не попытался ответить "по существу" на мои вопросы, а будто ведешь беседу сам с собой, и действительно "тут и добавить нечего".
Ну так вы же задаете вопросы, на которые уже получили ответ от Мятного дворецкого. Вы его слова проигнорировали.
А причем тут пресс-релиз? Вы разве сами не видите, как развиваются нейросети, где они были год назад, два года назад? За это время произошел качественный скачок во всех сферах, где задействованы нейросети. В том числе и в генерации видео прогресс поразительный. Нет никакого повода думать, что этот прогресс сейчас вдруг остановится. Вообще никаких предпосылок для этого нет. Вы же можете взвесить все что произошло за последние несколько лет и экстраполировать эти изменения на будущее?
Не, ну может быть когда-нибудь и упрется в какой-то потолок, но сейчас и близко на это не похоже: все время разрабатываются более быстрые и энергоэффективные чипы, новые технологии, новая архитектура и т.п.. Чтобы вдруг развитие генерации видео остановилось на 10 секунд - тут уже нужна искусственная воля всех компаний, которые этим занимаются. Но зачем им это? Даже если Open AI зачем-то посчитает, что 10 секунд достаточно, то так не сделают китайские коллеги.
Опять разглагольствования. Я тоже был наивным, но в 2024 году работая в Западной Африке на месторождении Симанду, заразился неизвестным вирусом, от которого у меня до сих пор последствия в виде нейропатии. Знаешь, когда я полгода не мог встать с кровати, то слышал множество различных экспертов от мира медицины, что вирусов таких не бывает и вообще у меня просто невроз, хотя я предоставил доказательства, что они ошибаются - сам сдавал анализы, регистрируя сдвиги в крови (это дерьмо похоже на ЦМВ или ВЭБ, но не бьётся никакими ИФА). Ты один из таких же балаболов, не в обиду сказано, которые типа все знают и доказывают другим, что они слепы.
Что касаемо Майкрософт, раз ты с ними на связи и знаешь внутреннюю кухню, то попроси у них пофиксить баги в Windows 11, когда после запуска периодически не работает сама панель управления. Уже год обновления летят, а проблема все еще присутствует. И это только одна из многих, но самая раздражающая. Хотя я сомневаюсь, что ты что-то можешь, кроме как нести "нейроевангелие" в массы.
Пресс-релиз является источником официальной информации, и только на него можно ориентироваться при составлении каких-то прогнозов. Предыдущий пресс-релиз Sor-ы не сильно отличался от текущего, а ведь с тех пор прошло полтора года. На сайте OpenAi есть showreel с Альтманом и Sora 2, состоящий из той же самой нарезки 5-секундных огрызков, поэтому можно предположить, что проблема масштабирования продолжительности видео существует. А ограничения всегда могут быть введены законодательно, к тому же подобные движения уже имеют место быть.
Истории же о производительности и энергоэффективности чипов я советую использовать в темах или новостях по обсуждению последнего поколения видеокарт Nvidia - там полно подобных шуток (даже могу добавить перл начала этого года: 5070=4090).
Ну так речь не про Open AI, в про индустрию вообще. Они и первую Sora представили, а потом их же обогнал Kling и все остальные. Поэтому да, инсайдерской информацией не владею, но это не важно, речь же не про определенную контору, или Вы именно про Open AI? Так на ней свет клином не сошелся, их первая Sora уже давно нафиг никому не нужна.
Тут же все просто, если буквально недавно нейросети не могли генерировать видео вообще, а сейчас могут и неплохо, но по 5-10 секунд, а Sora Pro по 15 секунд, то вы действительно искреннее можете допустить, что на этом прогресс закончится?
Проблема масштабируемости конечно существует, как и существовали другие проблемы, которые преодолены. С чего Вы решили, что именно эта проблема не будет решена?
Это новость про Sora, поэтому и мои вопросы касались этой нейросети и их владельца, что логично. Полтора года, которые прошли между версиями Sor-ы - это вполне себе срок, за который тот же Хуанг выпускает новое поколение видеокарт, а у OpenAI в showreel-е та же монтажная нарезка. Если бы проблему масштабирования продолжительности видео хотели решить, то нам бы показывали пролеты камеры в стиле Тарковского, а не тик-токи. И не все проблемы поддаются решению(выше был комментарий про Windows): например, тех. процессы при производстве чипов уменьшаются, что в теории должно увеличивать производительность, но пока стабильно растет энергопотребление и цена у видеокарт и процессоров.
К слову о цене, забавная новость с кликбейтным заголовком:
https://www.pcgamer.com/software/ai/fabulous-news-...
Дима, я не понимаю этого дворового жаргона.
Уверен, как только ты научишься формулировать связно то, что ты хочешь сказать или спросить, ты начнешь получать вразумительные ответы. И даже сможешь понять их, в силу своего разумения конечно.
Не понимаешь, но продолжаешь общаться в этой манере. Важно, что модераторы ее вовремя поняли и оценили.
Забавно, что это пишет автор вот таких пассажей "???????????????????????". Ты что-то срочно хотел узнать, или снова клавиша запала?
Ну вот прошло месяца 4 и вот ответ:
https://render.ru/ru/news/post/27831