인터뷰

제임스 카플란, MeetKai 메타버스 CEO & 공동 창립자 – 인터뷰 시리즈

mm
Unite.AI를 Google의 선호 소스에 추가

제임스 카플란은 로스앤젤레스에 기반을 둔 인공지능, VR, 대화형 검색 회사인 MeetKai의 CEO이자 공동 창립자입니다. MeetKai는 현재 인공지능 음성 인식 기술에서 새로운 기능을 통해 선두를 달리고 있습니다. 대화형 인공지능은 더 복잡한 언어를 이해하고 다양한 주제에 대해 자연스러운 대화에서 개인화된 결과를 제공할 수 있습니다. MeetKai의 기술은 전 세계적으로 iOS, Google Play, AppGallery를 통해 배포되고 있습니다.

6살 때부터 인공지능에 대한 열정을 가지게 된 이유는 무엇입니까?

저의 인공지능에 대한 소개는 비디오 게임에서 시작되었습니다. 처음에는 오레곤 트레일 게임에서 인공지능이 어떻게 작동하는지 이해하려고 노력했습니다. 그다음에 MMORPG에 관심을 가지게 되었습니다. 온라인 게임을 정말 좋아했지만 아이템을 모으는 것을 싫어했습니다. 그래서 봇을 작성하기 시작했습니다.

처음으로 작성한 인공지능 애플리케이션은 무엇입니까?

MMORPG용 봇을 작성하는 것이 처음으로 개발한 인공지능 형태였습니다. 처음에는 봇이 매우 간단했으며 매크로에 더 가까웠습니다. 그러나 게임에서 봇을 감지하는 기술이 발전함에 따라 봇을 더 발전시키게 되었습니다. 저는 항상 봇을 작성하는 것을 즐겼습니다. 학교에 다니던 시절에 테일러 스위프트 콘테스트에서 봇을 작성해서 우승하기도 했습니다. 또한 포켓몬 고 봇을 작성했지만 감지 회피에 관심을 잃어 많은 사람들이 밴 당했습니다.

2018年に MeetKai를 설립한 이유는 무엇입니까?

현재의 인공지능 음성 조작기가 제공하는 경험의 부족이 주요 문제입니다. 대부분의 인공지능 조작기는 외부 API에 너무 의존합니다. 심지어 Alexa와 같은 경우에도 전자상거래 검색에서 같은 문제가 있습니다. 음성 조작기가 지능적으로 작동하기 위해서는 전체 처리 파이프라인을 제어해야 합니다. 우리는 대화형 검색 엔진을 개발하여 더 복잡한 쿼리와 대화를 지원했습니다. 다른 조작기는 이러한 제한적인 요인으로 인해 다중 회전 대화 지원을 구축할 수 없습니다. 우리의 목표는 아직 초기 단계에 있지만 기술을 확장하여 기존 플레이어와 같은 도메인 수를 충족하는 것입니다.

인공지능 음성 조작기를 구축하는 자연어 이해와 처리의 도전은 무엇입니까?

다음과 같은 도전이 있습니다.

  1. 의도 분류가.context-free로 다중 회전 대화를 처리하지 못합니다. 대부분의 접근 방식은 전사된 원시 텍스트만을 고려합니다. 사용자에 대한 정보나 사용자가 좋아하는 정보를 고려하지 않습니다. 이는 사용자가 간결하게 말할 때 특히 중요합니다. 예를 들어, “코스모폴리탄”은 음료 또는 잡지일 수 있으며 사용자에 따라 달라집니다.
  2. 엔티티 인식 모델은 범주형 값이 아닌 경우 잘 작동하지 않습니다. 대규모 언어 모델은 데이터셋에 없는 새로운 엔티티에 빠르게 적응하지 못합니다. 인공지능은 더 복잡한 방식으로 엔티티를 인식해야 합니다. 예를 들어, 사용자의 위치는 음식점 이름인지 여부에 큰 영향을 미칩니다.
  3. 엔티티 관계가 잘 고려되지 않습니다. 내avorite 예는 대부분의 검색 엔진이 부정에 실패하는 것입니다. 다른 음성 조작기에서 “로맨스가 없는 영화”를 검색해 보세요.

MeetKai의 인공지능은 어떻게 다른가요?

MeetKai와 Google의 검색 차이점은 우리가 웹 페이지를 검색하는 대신 더 풍부한 언어 이해 모델을 사용하여 항목 자체를 검색한다는 것입니다. “톰 크루즈 영화에 액션이 없는”을 검색할 때 Google은 해당 토큰이 나타나는 페이지를 찾습니다. MeetKai는 톰 크루즈가 배우이고 영화가 미디어 클래스이며 액션이 원치 않는 장르라는 것을 올바르게 이해합니다. 이를 통해 더 지능적인 검색을 수행할 수 있습니다.

MeetKai 메타버스에 대해 설명해 주세요.

대부분의 메타버스 회사는 사람과 사람의 상호작용에 중점을 두고 있습니다. MeetKai 메타버스는 사람과 인공지능의 상호작용에 중점을 두고 있습니다. 우리는 대화형 인공지능으로 구동되는 캐릭터와 상호작용할 수 있는 메타버스를 개발하고 있습니다. 또한 환경을 더 현실적으로 만들기 위해 절차적 생성을 사용하고 있습니다. 현재 두 개의 초기 세계를 제공하고 있습니다. 하나는 명상이고 다른 하나는 미술관입니다. 명상 세계에서는 윙춘 전문가를 디지털화했으며 처음으로 사용자에게 혁신적인 명상 기술을 가르치는 인공지능 캐릭터를 만들었습니다. 미술관 세계에서는不断 성장하는 미술관을 만들었으며 미술에 대한 질문에 답변하고 투어를 제공할 수 있는 인공지능 큐레이터를 만들었습니다.

MeetKai 메타버스에서 인공지능을 사용하는 예는 무엇입니까?

인공지능을 세 가지 방법으로 사용합니다.

  1. 메타버스에서 각 캐릭터의 대화형 능력을 구동합니다.
  2. 사용자에게 음성 가이드를 통해 제공되는 콘텐츠를 동적으로 생성합니다. 예를 들어 명상 세션과 미술관 투어가 있습니다.
  3. 3D 공간을 수동 레이아웃이 아닌 절차적으로 생성합니다.

음성 조작기의 미래에 대한 비전은 무엇입니까?

음성 조작기가 미래를 가지기 위해서는 명령 기반 시스템을 넘어서야 합니다. 이는 여러 특정 도메인에서 전문 지식과 능력을 갖추는 것을 의미합니다. 여러 도메인별 음성 조작기를 조합하여 모든 지능형 메타 조작기를 구축하는 것이 핵심이라고 생각합니다. 이는 음성 조작기가 처음 등장했을 때부터看到한 “모든 것을 한 번에”하는 시도를 대조합니다.

MeetKai나 MeetKai 메타버스에 대해 더 공유하고 싶은 내용이 있나요?

우리는 아직 메타버스 로드맵의 초기 단계에 있습니다. 궁극적인 목표는 현실 세계에서 경험할 수 있는 모든 것을 메타버스에서 복제하고 넘어서는 것입니다. 이는 현실 세계에서 경험할 수 있는 것과 같은 비용과 시간을 제거하는 것을 의미합니다. 메타버스는 우리가 더 풍부한 삶을 살 수 있도록 해줄 것입니다. 아직 기술적인 도전이 남아 있지만 명확한 마일스톤이 있으며 하드웨어가 발전하면 이를 달성할 수 있을 것입니다. 우리는 VR 공간을 발전시키기 위해 하드웨어 파트너와密接하게 협력하고 있습니다. VR을 넘어서 메타버스 경험을 가능하게 하기 위해 노력하고 있습니다. 이를 위한 더 많은 정보를 곧 발표할 예정입니다.

감사합니다. MeetKai 메타버스에 대한 진행 상황을 지켜보겠습니다. 더 많은 정보를 원하는 독자는 MeetKai를 방문하세요.

앙투안은 유나이트.AI의 비전적인 리더이자 공동 설립자로서 AI와 로봇공학의 미래를 형성하고 촉진하는 데 대한 불변의 열정을 가지고 있습니다. 연속적인 기업가로서, 그는 AI가 사회에 전기와 같은 변화를 가져올 것이라고 믿으며, 종종 파괴적인 기술과 AGI의 잠재력에 대해 열광합니다.

作为 미래학자로서, 그는 이러한 혁신이 우리 세계를 어떻게 형성할지 탐구하는 데 헌신하고 있습니다. 또한, 그는 Securities.io의 설립자로서, 미래를 재정의하고 전체 부문을 재구성하는 최첨단 기술에 투자하는 플랫폼을 운영하고 있습니다.