В настоящее время практический опыт недоступен — пока доступны только демонстрационные видео.
- Google DeepMind только что представила Genie 3, свою самую передовую модель мира на сегодняшний день.
- В отличие от своей предшественницы Genie 2, эта версия позволяет мгновенно взаимодействовать и обеспечивает чёткое изображение с разрешением 720p.
- По сути, вы можете вызвать цифровую среду, перемещаться по ней и динамически изменять её с помощью новых подсказок по мере продвижения — и все это происходит плавно в режиме реального времени.
Модель искусственного интеллекта Google претерпела разительные изменения. Технологический гигант, а именно его подразделение DeepMind, представил Genie 3 — передовую модель искусственного интеллекта, которая представляет собой значительный шаг вперед. Теперь пользователи могут создавать богатые 3D-среды с разрешением 720p, исследовать все их аспекты и активно изменять мир на лету, выдавая новые команды — и всё это происходит мгновенно.
Это впечатляющее достижение, и я настоятельно рекомендую вам посмотреть видео с анонсом DeepMind, встроенное ниже. Genie 3 отличается даже от уже замечательного Veo 3, предлагая видео с синхронизированным звуком, которое намного превосходит предыдущий восьмисекундный барьер. Genie 3 расширяет то, что Google описывает как «горизонт взаимодействия», до нескольких минут, давая вам возможность взаимодействовать с окружающей средой и изменять её в течение длительной интерактивной сессии.
Представьте себе слияние искусственного интеллекта и виртуальной реальности: вы можете создать целый мир из одного промта, ввести новые элементы и свободно исследовать его. Genie 3 — это явное улучшение по сравнению с Genie 2, который дебютировал в конце 2024 года. Диаграмма, представленная в официальном посте DeepMind, иллюстрирует прогресс от GameNGen до Genie 2, который теперь завершился Genie 3, с параллельным сравнением с Veo.
Google также выпустила набор демонстрационных сценариев, некоторые из которых можно испытать прямо в блоге, что напоминает подход «выбери своё приключение». Вы найдёте подборку сцен для изучения — возможно, заснеженный холм или задача для ИИ, которую нужно выполнить в музее.
Google описывает это так: «Genie 3 — наша первая модель мира, позволяющая пользователю взаимодействовать с окружением в реальном времени, а также повышающая согласованность и реалистичность по сравнению с Genie 2». И я, и мои коллеги по цеху сразу же представили себе взаимодействие с этими средами через VR-гарнитуру — путешествие по неизведанным виртуальным местам или предоставление разработчикам игр мощного инструмента для создания окружающих ландшафтов и персонажей. Неудивительно, что Google рассматривает это как ещё один шаг к AGI — искусственному общему интеллекту. DeepMind считает, что Genie 3 может служить полигоном для обучения множества агентов ИИ, предлагая безграничные, высокоиммерсивные симулированные среды.
Заметным достижением Genie 3 является его новая способность поддерживать постоянство объектов. Например, в одной из демонстраций пара виртуальных рук держала валик и наносила синюю краску на стену. Покрашенные полосы оставались видимыми и точно расположенными даже после смены точки зрения, а затем возвращались — это свидетельствует о чувстве непрерывности системы.
Это напоминает постоянство объектов, которое Apple стремится обеспечить в visionOS 26 — хотя, честно говоря, подход Apple накладывает цифровые элементы на реальный мир, что является немного другим, хотя и впечатляющим достижением.

DeepMind признаёт текущие ограничения Genie 3. В своем нынешнем состоянии модель не может «воссоздавать реальные места с безупречной географической точностью» и в настоящее время поддерживает только несколько минут непрерывного взаимодействия. Хотя время работы Genie 3 значительно превосходит Genie 2, мы ещё не достигли стадии часовых иммерсивных сессий.

На данный момент прямой доступ к миру Genie 3 закрыт для широкой публики. Вход в настоящее время ограничен избранной группой тестеров. Google выразила намерение расширить доступность для дополнительных тестеров в будущем, хотя всё ещё определяет оптимальный подход для этого. Точный интерфейс для взаимодействия с Genie 3 ещё не анонсирован, но демонстрации, выпущенные на данный момент, показывают, что это действительно революционная технология.
Независимо от того, ограничит ли Google Genie 3 сферой исследований и разработок в области искусственного интеллекта или пойдет дальше в создании медиа-контента, я уверен, что появление Genie 4 — или, по крайней мере, значительное расширение возможностей Genie 3 — это лишь вопрос времени. А пока я буду довольствоваться экспериментами с Veo 3.














