AI 모델 및 플랫폼

정신 건강 인공지능 도구가 우연히 정확한 딥페이크 감지를 발견한 방법

mm
Unite.AI를 Google의 선호 소스에 추가

기술 거대 기업 오픈 AI가 2025년 9월에 플래그십 Sora 2 비디오 및 오디오 생성 모델을 출시했을 때, 딥페이크 비디오는 소셜 미디어 플랫폼을洪水처럼 범람하며, 관객들에게 잠재적으로 위험한 초현실적 콘텐츠를 점점 더 익숙하게 만들었습니다.

오픈 AI는 Sora 2의 책임 있는 출시를 최우선 순위로 간주했지만, 사용자가 “그들이 피드에서 볼 수 있는 것에 대한 제어권을 가지게” 하고, 종단 간에 그들의 유사성을 제어할 수 있는 도구와 선택권을 제공할 것이라고 주장했지만, 2025년 10월 뉴스 가드 테크의 연구에 따르면, 이 모델은 80%의 시간에 거짓 주장을 생성했습니다.

딥스트라이크의 2025년 9월 보고서에 따르면, 딥페이크 콘텐츠는 2023年的 50만 개에서 2025年的 800만 개로 증가했으며, 대부분이 사기 목적으로 사용되었습니다.

이러한 추세는停止하는迹象이 없습니다. 미국에서만 AI 사기는 2027년까지 400억 달러에 달할 것으로 예상됩니다.

딥페이크 감지는 점점 더 어려워지고 있습니다. 전통적인 딥페이크 감지 방법은 실패하고 있으며, 음성 딥페이크는 두 번째로 흔한 형태의 AI 기반 사기입니다.

“몇 초의 오디오만으로도 자연스러운 음调, 리듬, 강조, 감정, пауз, 호흡 소음을 가진 설득력 있는 클론을 생성할 수 있습니다.”라고 Lyu는 썼습니다.

소라를 넘어서: 보이스 피싱

오픈 AI의 도구가 출시되기 전에, 딥페이크 파일의 생성과 온라인 배포는 이미 증가하고 있었습니다. 딥스트라이크의 보고서에 따르면, 딥페이크 콘텐츠는 2023年的 50만 개에서 2025年的 800만 개로 증가했으며, 대부분이 사기 목적으로 사용되었습니다.

이러한 추세는停止하는迹象이 없습니다. 미국에서만 AI 사기는 2027년까지 400억 달러에 달할 것으로 예상됩니다.

딥페이크 감지는 점점 더 어려워지고 있습니다. 전통적인 딥페이크 감지 방법은 실패하고 있으며, 음성 딥페이크는 두 번째로 흔한 형태의 AI 기반 사기입니다.

Kintsugi는 건강 기술 스타트업으로, 임상 우울증과 불안을 감지하기 위한 음성 바이오마커 기술을 개발하고 있습니다. 그들의 작업은 간단한 전제에서 시작되었습니다. “우리는 인간을 들어야 합니다.”

인간을 들어야 하는 과학

Kintsugi의 창립자 그레이스 창은 개인적으로 경험한 문제로 인해 회사를 설립했습니다. 그는 5개월 동안 치료를 예약하기 위해 제공업체에 전화를 걸었지만, 아무도 전화를 받지 않았습니다.

연구에 따르면, 음성 바이오마커는 우울증과 불안을 감지하는 데 78%에서 96%의 정확도를 가지고 있습니다. Kintsugi는 음성 클립을 요청하고, 음성 바이오마커 기술을 사용하여 음调, 음색, пауз를 분석합니다.

Kintsugi의 기술은 Revolution을 위한 것입니다. 그것은 음성 딥페이크 감지와 사이버 보안에 대한 새로운 접근법을 제공합니다.

정신 건강 관리에서 사이버 보안까지

창은 뉴욕에서 열린 정상 회의에서 사이버 보안 분야의 친구에게 합성 음성에 대한 실험을 언급했습니다. “우리는 합성 데이터를 사용하여 우리의 정신 건강 모델을 훈련시키기 위해 실험을 했지만, 생성된 음성은 실제 인간 음성과 너무 다르었습니다.”

FBI는 2025년 4월에 악의적인 텍스트 및 음성 메시지 캠페인에 대해 경고했습니다. 이 캠페인은 미국 고위官僚를 가장하여 전직 정부 직원과 그들의 연락처를 대상으로 했습니다.

Kintsugi의 기술은 인간 음성의 진위를 감지하는 데 사용할 수 있습니다. 그것은 Revolution을 위한 것입니다. 그것은 음성 딥페이크 감지와 사이버 보안에 대한 새로운 접근법을 제공합니다.

인간 중심 기술의 미래

Kintsugi의 발견은 인간 本身에 대한 베팅입니다. “우리는 완전히 다른 표면 영역에서 작동합니다. 인간의 진위를 감지하는 것입니다. LLMs는 LLM 생성 콘텐츠를 신뢰할 수 없습니다. 그리고 유물 기반 방법은 취약합니다.”

창은 인간의 진위를 감지하기 위한 표준이 되고 싶습니다. “HTTPS는 웹의 기본 신뢰 계층이 되었습니다. 우리는 ‘인간의 증거’가 음성 기반 시스템의 기본 계층이 될 것이라고 믿습니다. 시그널은 그 인프라의 시작입니다.”

창은 인간이 인간인 것을 이해하는 것이 가장 효과적인 방어 수단이 될 것이라고 믿습니다. “인간의 본질을 이해하는 것이 가장 효과적인 방어 수단이 될 것입니다.”

살로메는 메데인에서 태어난 저널리스트이며 Espacio Media Incubator의 시니어 리포터입니다. 역사와 정치학을 배경으로, 살로메의 작업은 새로운 기술의 사회적 관련성을 강조합니다. 그녀는 알자지라, 라틴 아메리카 리포트, 소사블 등에서 소개되었습니다.