На первый взгляд это обычный репортаж с автовыставки в США: новейшие модели автомобилей, толпы посетителей, журналисты берут интервью у представителей компаний. Однако в действительности ни одного реального автомобиля, человека или даже помещения не существует - всё, от изображений до фонового шума, было сгенерировано нейросетью Veo 3 на основе простого текстового запроса.
Технология достигла уровня, когда отличить сгенерированное видео от реального почти невозможно. В ближайшие годы такие гиперреалистичные генерации могут заполнить интернет, что создаст серьёзные вызовы для медиапространства.
И заметьте это вообще никто не контролирует и нет возможности отличить от реальности (в ближайшем будущем точно + те кто будут разносить все вокруг точно не будут задумываться о генерации и врядли будут способны выговорить такое слово).
Это ведь очень серьезно, сейчас наступил тот момент, когда больше нельзя доверять ничему что ты видишь или слышишь по телевизору или в интернете, вообще ничему нигде, только если ты видел это глазами. Вдумайтесь...
Проблема в том, что далеко не каждый будет присматриваться
Тут дело даже не в том, то этого не увидят 99,9%, проблема в том, что этой проблемы не будет уже через несколько месяцев или чуть больше.
А то, что не специалисты не поймут, это не беда, не специалисты они на то и не специалисты, чтобы не разбираться, они и сейчас многие картинку из Анрил видят как фотореалистичную. Так что вопрос в другом, сможет ли ИИ победить реальность?
Возмьмите ролики сделанные в Veo разных версий (1, 2, 3) и заметьте какой между ними прогресс, заметьте сколько времени прошло между выпуском разны версий и представьте что будет дальше. Пока никаких ограничений, ни технических, ни концептуальных не предвидится. Наоборот, только что, буквально месяцы назад появились мультимодальные агентные сети, которые общаются друг с другом по своему протоколу и каждый агент в этой сети может бысть обучен так, чтобы быть специалистом в своей отдельной области, например генеририровать стиль (на уровне хорошего художника), или композицию и динамика кадра (на уровне хорошего оператора), общий сценарий (на уровне хорошего сценариста). Даже можно запилить отдельную модель которая генерирует крутые тачки по описаниям и отдает результат дальше, для вставки в кадр. Пока эти технологии только-только начинают внедрятся. Потенциал там на ближайшие 10 лет не исчерпается, это 100%, даже не все еще попробовали.
Если в модель не подавать никаких стилистических указаний в промте, то она понятно будет делать это в "своем родном стиле", и большинство пользовтелей не заморачиваются. А вот попробуйте в запрос добавить что-то типа "немного абстрактных форм, очень четкие края объектов, почти линии, то что на заднем фоне должно быть не в фокусе но подсвечено разноцетным светом, и чуть-чуть стиля из фантастических фильмов 80-х, но не очень много" и вот пожалуйста уже совершенно другой резульатат. Просто никто не заморачивается. Тыкают один запрос и хотят какой-то уникальности.
Но вот если все делать правильно, то уже на глаз сложно отличить, особенно если это новая модель.
Ну он уже победил. Проблема как раз в не специалистах. Понимаете, если группа людей увидит, что какой-то известный человек на видео оскорбляет их идеалы (допустим веру), они не будут разбираться, они просто уничтожат этого человека. Так можно спровоцировать волнения, панику, обвал рынка, что угодно, раньше такого инструмента не было. Уже сейчас новости предупреждают, что через 6 мес. людям нужно быть готовыми к волне дипфейков от мошенников, неотличимых от реальных людей, говорящих реальными голосами родственников и т.д.
Вот тут проблемка приплывает, допустим человек чего-то не говорил, а его обвинили по нейросъемке, причем по закону ему лет 15 дадут, а доказать возможности нет. Хотя видео с ним ущемило сотни тысячь людей и они будут требовать крови. Вот где оно вылезет, а не не на рынке игр или CG.
В общем кроме как ограничивать подобные технологии я иного выхода не вижу, что скорее всего и будут делать. Но фейки будут появляться скорее всего и без того...
Ну вообще, они и вкладываются. Разработка почти всех современных лекарств идет при помощи ИИ. А на этом просто отрабатывают технологии, за счет массовости.