AR, XR и нейроинтерфейсы

Будущее очков дополненной реальности – это AI-ориентированное

mm
Добавьте Unite.AI в избранные источники в Google

Прогресс в области искусственного интеллекта доминирует в повседневных разговорах. Применения AI, кажется, бесконечны – и не удивительно, что это изменит наш мир и то, как мы взаимодействуем с ним. Вместе с многими другими отраслями это особенно актуально для дополненной реальности.

Модели AI уже используются для создания иммерсивных trải nghiệm дополненной реальности – особенно в приложениях для мобильных устройств. Области дополненной реальности и искусственного интеллекта работают вместе, чтобы создать интуитивные и уникальные trải nghiệm, которые более полно объединяют реальный и цифровой миры. Следующая граница в разработке AI и AR – это реализация передовых возможностей AI в потребительских очках дополненной реальности, чтобы расширить возможности иммерсивного взаимодействия.

Генеративный AI ускорит создание 3D миров и создаст бесконечные возможности для носителей, чтобы создать свои собственные реальности

Генеративный AI включает в себя достижения в алгоритмах, языковых моделях и увеличении вычислительной мощности, необходимой для выполнения необходимых расчетов для картографирования и взаимодействия с физическим миром.

На данный момент существует ограничения на 3D-модели в очках дополненной реальности, поскольку они по сути являются ручными. Однако генеративный AI может создавать эти модели очень быстро и автономно. Генеративный AI в очках дополненной реальности поможет создавать 3D-модели быстрее, разблокируя полный потенциал дополненной реальности. Это создание цифрового мира для наложения на физический мир будет быстрее, более полным и иммерсивным без необходимости интенсивного ручного труда.

Генеративный AI также изменит опыт пользователя и то, как мы взаимодействуем с физическим пространством. С очками дополненной реальности, оснащенными генеративным AI, носители могут буквально перенести свое воображение в реальный мир. Без необходимости программирования носители могут использовать распознавание голоса, чтобы “говорить” свои изображения и 3D-объекты через свои очки дополненной реальности именно так, как они хотят. Они могут сказать: “Представьте, что в комнате плавает дельфин” – и он появится перед ними. Возможности для этого погружения практически бесконечны для развлечений, работы и многого другого.

Очки дополненной реальности, оснащенные генеративным AI, также изменят мир игр, создавая более иммерсивный и персонализированный игровой опыт. Например, с ChatGPT будет проще создавать более реалистичных персонажей и добавлять новые квесты или игровые миры. Это также можно использовать для улучшения игрового опыта, анализируя поведение игрока и делая игру проще или более сложной для игрока в реальном времени, настраивая опыт автономно.

AI-ориентированный перевод речи и письменного текста уменьшит языковые барьеры

Автоматическое распознавание речи (ASR) использует нейронную сеть аудиовизуального распознавания речи (алгоритм, который полагается на обработку изображений для извлечения текста). Это может переводить письменный текст – например, меню в чужой стране – в реальном времени на ваш родной язык.

Когда это применяется в очках дополненной реальности, это может обеспечить субтитры на вашем родном языке в реальном времени, пока кто-то говорит на другом языке – все в рамках ваших очков дополненной реальности. Это устраняет разочарование туристов и бизнесменов, пытающихся общаться на местном языке, и создает более коммуникативный и сотруднический мир.

Распознавание текста и перевод сочетают AI-техники оптического распознавания символов (OCR) с двигателями перевода текста на текст, такими как DeepL. Двигатели AI, такие как Stable Diffusion, также могут дополнить вашу коммуникацию анимациями или другими визуальными средствами, которые могут помочь передать сложные или подробные концепции. Это углубляет вовлеченность пользователя: очки дополненной реальности, оснащенные этим AI, могут отображать соответствующее изображение или видео в реальном времени, актуальное для того, что говорит пользователь перед ними на панели или презентации. Google недавно анонсировал разработку очков дополненной реальности с этой функциональностью.

Это также позволяет глухой общине участвовать в повседневных разговорах без необходимости читать по губам или поддерживать зрительный контакт, мгновенно преобразуя аудио в субтитры, отображаемые перед глазами носителя.

AI делает свое присутствиеfelt в здравоохранении, образовании и многих других областях. Скоро у нас будут умные очки дополненной реальности, которые, как популярная научная фантастика, перенесут людей в дополненную или виртуальную реальность, где AI быстро картографирует комнату и позицию говорящего, чтобы сделать виртуальную коммуникацию беспрепятственной и менее громоздкой, независимо от того, где находится каждая сторона.

AI помогает очкам дополненной реальности легко обнаруживать и помечать объекты в реальном мире – углубляя вовлеченность.

Свёрточная нейронная сеть (CNN) алгоритмов обнаружения объектов в настоящее время используется в мобильных устройствах для оценки положения и размера объектов в сцене. Как только он обнаруживает объект, программное обеспечение дополненной реальности может наложить текст на него или сгенерировать другой объект в физический мир и создать взаимодействие между ними. Объекты, перенесенные в реальный мир, имеют многочисленные применения, включая инструкции, навигацию, диету и питание, и многие другие.

Когда вы носите очки дополненной реальности с этими возможностями AI, например, пользователь может прогуляться по улицам любого города и узнать о любом ориентире в реальном времени, глядя на него. Очки дополненной реальности могут идентифицировать, помечать и предоставлять информацию о городе и его ориентирах – все через оправу носителя. По мере улучшения технологии распознавания объектов будут доступны данные о питании, такие как калории, белки, жиры и холестерин любой пищи и размера порции. Тем временем простые QR-коды на продуктах вызовут подробную информацию о питании для пользователей.

Помимо чистого обнаружения объектов, программное обеспечение распознавания лиц также становится все более распространенным для людей обнаружения. Уже распознавание лиц набирает популярность в авиационной промышленности, поскольку все больше рейсов используют эту технологию для подтверждения личности пассажира – добавляя дополнительный уровень безопасности и ускоряя процесс посадки. Распознавание лиц, когда оно используется в очках дополненной реальности, может дать носителям возможность распознавания где угодно. Например, в ближайшем будущем с очками дополненной реальности вы можете встретиться с другими в социальных сетях и получить их информацию о фоне мгновенно, прежде чем решить, хотите ли вы “дружить” или связаться с ними.

Очки дополненной реальности, оснащенные AI, меняют нашу жизнь, и их визуальные и технические возможности будут продолжать улучшаться. В нашем все более взаимосвязанном мире они упрощают задачи и ломают барьеры, которые всего несколько лет назад считались непреодолимыми. Прогресс в области искусственного интеллекта происходит так быстро, что в течение следующих 10 лет AI сделает больше прогресса, чем за предыдущие 50 лет. Будь то правительство, бизнес или личная среда, искусственный интеллект скоро сольется с очками дополненной реальности, чтобы объединить наши физические и цифровые среды.

Ari Grobman является CEO в Lumus. Ari - ветеран индустрии AR с почти 15-летним опытом коммерциализации оптики Lumus. На своей предыдущей должности в Lumus в качестве вице-президента по развитию бизнеса Ari представил Lumus ведущим технологическим компаниям по всему миру. Он привносит глубокое знание индустрии AR в компанию.