Genie 3 - это новая модель миров от DeepMind, способная создавать интерактивные 3D-среды, с которыми можно взаимодействовать в реальном времени. В отличие от своих предшественников, она поддерживает стабильную симуляцию в течение нескольких минут и запоминает расположение объектов даже за пределами кадра. Это делает модель более устойчивой и пригодной для сложных сценариев, например, тренировки ИИ-агентов или тестирования автопилотов.
Одним из ключевых новшеств Genie 3 стала функция promptable world events - возможность изменять состояние виртуального мира через текстовые запросы. Пользователь может, например, добавить в сцену персонажа или изменить погоду прямо во время симуляции. Такие изменения происходят в реальном времени, чего не умели прошлые версии.
Технически модель теперь работает в разрешении 720p при 24 кадрах в секунду, что вдвое выше, чем у предыдущей версии. Кроме того, система гораздо дольше сохраняет целостность мира, предотвращая так называемые «галлюцинации» ИИ, при которых симуляция искажается или рушится.
Пока Genie 3 доступна лишь в ограниченной исследовательской версии - только небольшой группе учёных и разработчиков. Google подчёркивает, что такая стратегия направлена на выявление возможных рисков и совершенствование технологии, прежде чем она станет доступной более широкой аудитории.
Genie 3 - не просто шаг вперёд в области генеративных моделей, а инструмент, который может стать основой для обучения будущих ИИ-систем в богатых, реалистичных и управляемых цифровых мирах. Хотя до полноценного искусственного общего интеллекта (AGI) ещё далеко, модели миров вроде Genie 3 уже прокладывают к нему технологический путь.
В детстве была игра под названием "сломанный телефон".
Но там всё в зачаточном состоянии.
Это временное явление. Гораздо перспективнее здесь то, что в данном концепте можно создавать игру под себя, конкретно здесь и сейчас, с нужными фишками и "ограблением корованов". Потому-что мне интереснее играть пусть не в очень супер уникальную и красивую игру с миллардами вручную сделанных моделек, а в ту игру, которая будет под меня подстраиваться, и где я могу написать "а теперь, давай, из-за угла выходит стража с топорами и мечами и устроим боевочку", а не я завишу от скриптов и воображения какого-то там геймдизайнера и общемировых повесточек.
И сейчас те, кто предложит играбельное решение просто порвут весь этот рынок игр нафиг. Даже пусть до этого придется еще 10 лет подождать. Никто не сможет с этим конкурировать. Даже если фиговую игру вручную небольшой командой делать полгода, то тут в динамике она генерируется и подстраивается под хотелки мновенно. Ну или ладно, если будет генрироваться еще какая-то глубокая история и окружение, ну пусть минуты.
А реализовать память. Фигня делов, на самом то деле. Просто сейчас поток подстраивается под предыдущие картинки, а должен опираться на дескрипторы например описанные в формате json. И если там будет отмечено что "в координатах x=10 y=35 находится дерево которое сгенеририровано с seed=492093029", то воспроизвести это потом фигня делов. Я даже примерно представляю какие будут следующие шаги по доработки этой штуковины и как их реализовать.