AR, XR 및 뇌 인터페이스

AR 안경의 미래는 AI를 탑재한 것입니다

mm
Unite.AI를 Google의 선호 소스에 추가

인공 지능의 발전은 주류 대화의 중심에 있습니다. AI의 응용 분야는 무한한 것으로 보이며, 그것이 우리의 세계와 우리가 그것과 상호 작용하는 방식을 변革할 것이라는 것은 놀라운 일이 아닙니다. 많은 다른 산업과 마찬가지로, 이것은 증강 현실에도 특히 적용됩니다.

AI 모델은 이미 몰입형 AR 경험을 구축하는 데 사용되고 있습니다. 특히 모바일 장치 앱에서 그렇습니다. 증강 현실과 인공 지능의 분야는 더 심층적으로 실제와 디지털 세계를 혼합하는 직관적이고 고유한 경험을 창조하기 위해 협력하고 있습니다. AI와 AR 개발의 다음 전선은 소비자 AR 안경에 고급 AI 기능을 구현하여 몰입형 참여의 가능성을 확장하는 것입니다.

생성적 AI는 3D 세계의 생성을 가속화하고, 착용자가 자신의 현실을 창조할 수 있는 무한한 가능성을 제공할 것입니다

생성적 AI는 알고리즘, 언어 모델 및 물리적 세계와 상호 작용하기 위해 필요한 계산을 수행할 수 있는 처리 능력의 향상을 포함합니다.

현재, AR 안경의 3D 모델에는 제한이 있습니다. 왜냐하면 그들은 본질적으로 수동적이기 때문입니다. 그러나 생성적 AI는 이러한 모델을 매우 빠르게 자동으로 생성할 것입니다. AR 안경의 생성적 AI는 3D 모델을 더 빠르게 구축하여 AR의 전체 잠재력을 해방시킬 것입니다. 디지털 세계를 물리적 세계에 오버레이하는 이 생성은 더 빠르고, 더 완전하고, 수동 노동 없이 몰입형으로 될 것입니다.

생성적 AI는 또한 사용자 경험과 물리적 공간과의 상호 작용을 변革할 것입니다. 생성적 AI를 탑재한 AR 안경을 착용하면 사용자는 실제 세계에 자신의 상상을 직접 투영할 수 있습니다. 코드를 작성할 필요 없이, 사용자는 음성 인식을 통해 AR 안경을 통해 원하는 대로 이미지와 3D 객체를 “말”할 수 있습니다. 그들은 “방에 돌고 있는 돌고래가 있다”고 말할 수 있으며, 그것은 그들의 눈 앞에 나타날 것입니다. 이러한 몰입의 기회는 엔터테인먼트, 업무, 그 이상을 위해 거의 무한합니다.

생성적 AI를 탑재한 AR 안경은 또한 게임 세계를 변革하여 더 몰입형이고 개인화된 게임 경험을 창조할 것입니다. 예를 들어, ChatGPT와 함께, 더 실제적인 캐릭터를 생성하고 새로운 퀘스트 또는 게임 세계를 추가하기가 더 쉬워질 것입니다. 또한 플레이어의 행동을 분석하고 게임을 실시간으로 더 쉽거나 더 어려운 게임 경험을 제공하여 게임 경험을 개선하는 데 사용될 수 있습니다.

AI를 탑재한 음성 및 텍스트 번역은 언어 장벽을 줄일 것입니다

자동 음성 인식(ASR)은 신경망 오디오 비주얼 음성 인식(이미지 처리를 사용하여 텍스트를 추출하는 알고리즘)을 사용합니다. 이것은 외국어로 된 메뉴와 같은 작성된 텍스트를 실시간으로 사용자의 모국어로 번역할 수 있습니다.

AR 안경에 적용될 때, 이것은 사용자의 모국어로 실시간 자막을 제공할 수 있습니다. 즉, 누군가 다른 언어로 말할 때, AR 안경의 프레임 내에서 자막이 표시됩니다. 이것은 여행자와 비즈니스맨이 현지 언어로 의사 소통하려고 하는데 있어 발생하는 좌절을 제거하고, 더 의사 소통하고 협력적인 세계를 조성합니다.

텍스트 인식과 번역은 AI 광학 문자 인식(OCR) 기술과 텍스트-텍스트 번역 엔진인 DeepL을 결합합니다. Stable Diffusion과 같은 AI 엔진은 또한 사용자의 의사 소통을 애니메이션 또는 기타 시각적 도구와 같은 것으로 보충하여 복잡하거나 자세한 개념을 전달하는 데 도움이 될 수 있습니다. 이것은 사용자의 참여를 심화시킵니다. AI를 탑재한 AR 안경은 사용자가 패널이나 프레젠테이션에서 말하는 내용과 관련된 이미지를 실시간으로 표시할 수 있습니다. Google은 최근에 이 기능을 갖춘 AR 안경을 개발하고 있다고 발표했습니다.

또한 청각 장애인들이 입술을 읽거나 눈을 마주칠 필요 없이, 즉시 오디오를 자막으로 변환하여 사용자의 눈 앞에 표시함으로써 일상 대화에 참여할 수 있도록 합니다. 청각 장애인 커뮤니티를 위한 것입니다.

AI는 의료, 교육, 그리고 다른 많은 분야에서 자신의 존재를 느끼고 있습니다. 곧 우리는 인공 지능이 빠르게 방의 레이아웃과 화자의 위치를 매핑하여 가상 의사 소통을 원활하고 더 덜 번거로운 환경으로 만드는 기능을 갖춘 스마트 AR 안경을 갖게 될 것입니다.

AI는 AR 안경이 실제 세계의 객체를 쉽게 감지하고 레이블링하여 참여도를 깊게 만듭니다

합성 신경망(CNN) 알고리즘은 현재 모바일 장치에서 장면 내 객체의 위치와 범위를 추정하는 데 사용됩니다. 한旦 객체를 감지하면, AR 소프트웨어는 객체에 텍스트를 오버레이하거나 물리적 세계에 다른 객체를 생성하여 두 객체 간의 상호 작용을 만들 수 있습니다. 실제 세계에 투영된 객체는 교육, 내비게이션, 식단 및 영양, 그리고 다른 많은 응용 분야를 갖습니다.

예를 들어, 이러한 AI 기능을 탑재한 AR 안경을 착용하면, 사용자는 어떤 도시의 거리를 걸으면서도 랜드마크를 실시간으로 확인하고 정보를 얻을 수 있습니다. AR 안경은 도시와 랜드마크를 식별하고 레이블링하고 정보를 제공할 수 있습니다. 객체 인식 기술이 개선됨에 따라, 음식과 음식 양에 대한 영양 데이터(칼로리, 단백질, 지방, 콜레스테롤 등)는 사용자에게 제공될 것입니다. 한동안, 제품의 단순한 QR 코드는 사용자에게 영양 정보를 제공할 것입니다.

객체 감지 외에도, 사람 감지를 위한 얼굴 인식 소프트웨어도 일반화되고 있습니다. 이미 얼굴 인식은 항공 산업에서 더 많은 비행이 이 기술을 사용하여 승객의 신원을 확인하고 보안 계층을 추가하며 보딩 과정을 가속화하는 데 사용되고 있습니다. 얼굴 인식이 AR 안경에 탑재되면, 사용자에게 인식 능력을 제공할 수 있습니다. 예를 들어, 가까운 미래에 AR 안경을 사용하면, 사용자는 소셜 미디어에서 다른 사람을 만나고 즉시 배경 정보를 얻을 수 있습니다.

AI를 탑재한 AR 안경은 우리의 삶을 변화시키고 있으며, 그들의 시각적 표현과 능력은 계속해서 개선될 것입니다. 우리의 점점 더 연결되는 세계에서, 그들은 과제를 단순화하고 몇 년 전에는 불가능하다고 생각했던 장벽을 깼습니다. 인공 지능의 발전은 매우 빠르게 진행되고 있으며, 향후 10년 동안 AI는 이전 50년 동안보다 더 많은 발전을 이루어 낼 것입니다. 정부, 비즈니스, 또는 개인 환경에서, 인공 지능은 곧 AR 안경과 결합하여 우리의 물리적과 디지털 환경을 혼합할 것입니다.

Ari Grobman은 Lumus의 CEO입니다. Ari는 거의 15년 동안 Lumus 광학을 상업화한 AR 산업의 베테랑입니다. Lumus의 이전 역할에서 비즈니스 개발 부문장으로서, Ari는 Lumus를 전 세계의 주요 기술 회사에 소개했습니다. 그는 회사의 AR 산업 지식의 깊이를 가지고 있습니다.