AI 모델 및 플랫폼
에코스피치: 음성 없는 음성 인식 기술로 의사소통 혁신

콘奈尔 대학교의 연구진은 에코스피치를 개발하였는데, 이는 음성 없는 음성 인식 인터페이스로 음향 감지 및 인공지능을 사용하여 31개의 비음성 명령을 연속적으로 인식할 수 있습니다. 이 저전력, 착용 가능한 인터페이스는 스마트폰에서 작동할 수 있으며 명령 인식을 위해 사용자 훈련 데이터가 몇 분만 필요합니다.
정보과학 박사 과정의 루둥 장(Ruidong Zhang)은 “에코스피치: 최소한의 방해를 받지 않는 안경에 탑재된 음향 감지 기술을 사용한 연속적인 음성 없는 음성 인식“의 주요 저자로, 이 논문은 이번 달 독일 함부르크에서 열리는 컴퓨터 과학 협회 인간 컴퓨팅 시스템 회의(CHI)에서 발표될 예정입니다.
“음성을 내지 못하는 사람들을 위해 이 음성 없는 음성 기술은 음성 합성기에 입력으로 사용될 수 있습니다. 이는 환자들에게 그들의 목소리를 되찾아줄 수 있습니다”라고 장은 말했습니다. 그는 기술의 잠재적인 응용 분야를 강조했습니다.
실제 적용과 개인 정보 보호의 이점
현재 에코스피치는 음성이 불편하거나 부적절한 환경에서 스마트폰을 통해 다른 사람들과 의사소통할 수 있습니다. 예를 들어, 시끄러운 레스토랑이나 조용한 도서관에서 사용할 수 있습니다. 음성 없는 음성 인터페이스는 또한 스타일러스와 함께 사용할 수 있으며 CAD와 같은 디자인 소프트웨어와 함께 사용하면 키보드와 마우스의 필요성을 크게 줄일 수 있습니다.
연필 이렁저리보다 작은 마이크와 스피커를 장착한 에코스피치 안경은 착용 가능한 인공지능 기반 소나 시스템으로 작동하여 얼굴을 가로지르는 음파를 보내고 받으며 입의 움직임을 감지합니다. 이후 깊은 학습 알고리즘이 이 에코 프로파일을 실시간으로 분석하여 약 95%의 정확도를 달성합니다.
“우리는 소나를 몸에 탑재하고 있습니다”라고 정보과학 조교수이자 콘奈尔 대학교의 스마트 컴퓨터 인터페이스 미래 상호작용 연구소(SciFi Lab) 책임자인 청 장(Cheng Zhang)은 말했습니다.
기존의 음성 없는 음성 인식 기술은 일반적으로 미리 정의된 명령어 집합을頼하며 사용자가 카메라를 마주하거나 착용해야 합니다. 청 장은 이것이 실제적이지도 않고 실행 가능하지도 않으며 사용자와 상호작용하는 사람 모두에게重大한 개인 정보 보호 우려를 일으킨다고 설명했습니다.
에코스피치의 음향 감지 기술은 착용 가능한 비디오 카메라의 필요성을 제거합니다. 또한 오디오 데이터는 이미지 또는 비디오 데이터보다 작기 때문에 처리에 필요한 대역폭이 적으며 블루투스를 통해 실시간으로 스마트폰으로 전송할 수 있습니다. 정보과학 교수인 프랑수아 귀مبر티에(François Guimbretière)는 이렇게 말했습니다.
“또한 데이터가 클라우드에 업로드되지 않고 스마트폰에서 로컬로 처리되므로 개인 정보 보호에 민감한 정보는 절대로 사용자의 통제를 벗어나지 않습니다”라고 그는 말했습니다.












