AI 모델 및 플랫폼
비제이 발라수브라마니안, 핀드롭의 공동 창립자 및 CEO – 인터뷰 시리즈

비제이 발라수브라마니안은 핀드롭의 공동 창립자이자 CEO입니다. 그는 구글, 지멘스, IBM 리서치, 인텔에서 다양한 엔지니어링 및 연구 역할을 수행했습니다.
핀드롭‘s 솔루션은 음성 상호작용의 모든 면에서 신원, 보안, 신뢰의 표준을 설정함으로써 음성의 미래를 주도하고 있습니다. 핀드롭의 솔루션은 특허된 기술을 사용하여 모든 통화와 음성에서 지능을 추출하여 세계에서 가장 큰 은행, 보험 회사, 소매업체를 보호합니다. 핀드롭 솔루션은 사기꾼을 감지하고 진정한 고객을 인증하여 사기와 운영 비용을 줄이고 고객 경험을 개선하며 브랜드 평판을 보호합니다. 핀드롭은 2011年に Dr. 비제이 발라수브라마니안, Dr. 폴 저지, Dr. 무스타크 아하마드에 의해 설립된 개인 회사로, 애틀랜타에 본사를 두고 있으며, 앤드레센 호로비츠, 시티 벤처스, 펠리시스 벤처스, 캐피탈G, GV, IVP, 비트루비안 파트너스에 의해 벤처 자금을 지원받고 있습니다. 자세한 정보는 핀드롭 웹사이트를 방문하십시오.
핀드롭의 2024년 음성 지능 및 보안 보고서에서 음성 기반 사기 및 보안의 현재 상태에 대한 주요 내용은 무엇입니까?
이 보고서는 금융 및 비금융 기관을 위한 연락 센터에서 특히 보안 문제와 미래의 트렌드에 대한 심층적인 분석을 제공합니다. 보고서의 주요 결과로는 다음이 있습니다:
- 연락 센터 사기 증가: 연락 센터 사기는 지난 2년 동안 60% 증가하여 2019년 이후最高 수준에 달했습니다.今年 말까지 연락 센터에 걸려오는 모든 730통의 통화 중 1통은 사기일 것으로 예상됩니다.
- 딥페이크 공격의 증가: 딥페이크 공격, 특히 합성 음성 클론은 증가하고 있으며, 미국 연락 센터에 대한 사기 위험은 약 50억 달러로 추정됩니다. 이 기술은 자동화된 계정 탐색, 음성 모방, 타겟 스미싱, 사회 공학 공격과 같은 사기 전략을 강화하는 데 사용됩니다.
- 전통적인 사기 탐지 및 인증 방법의 한계: 회사들은 여전히 소비자에 대한 수동 인증에 의존하고 있으나, 이는 시간이 걸리고 비용이 많이 들며 사기를 막는 데 효과적이지 않습니다. 데이터 침해의 피해자는 3억 5천만 명, 인증에 연간 120억 달러를 사용하며, 사기에 100억 달러를 잃는 것으로 나타났습니다. 이는 현재의 보안 방법이 효과적이지 않음을 보여줍니다.
- 새로운 접근 방식 및 기술의 필요성: 라이브니스 감지는 나쁜 AI를 방지하고 보안을 강화하는 데 중요합니다. 음성 분석은 여전히 중요하지만, 라이브니스 감지 및 다중 요소 인증과 함께 사용되어야 합니다.
보고서에 따르면, 미국 소비자의 67.5%가 은행 부문에서 딥페이크에 대해 우려하고 있습니다. 금융 기관이 직면한 딥페이크 위협의 유형에 대해 자세히 설명해 주십시오.
전화 채널을 통해 은행 사기가 증가하고 있습니다. 금융 기관은 고객이 의심스러운 활동을 확인하도록 의존하기 때문에, 연락 센터는 사기꾼의 주요 목표가 됩니다. 사기꾼은 고객 서비스 대표자를 속여서 제한을 해제하거나 온라인 뱅킹 자격증명을 재설정하는 데 사용하는 사회 공학 전략을 사용합니다. 한 핀드롭 은행 고객에 따르면, 확인된 사기 통화의 36%는 사기 통제로 인해 제한을 해제하는 것을 목표로 했습니다. 또 다른 핀드롭 은행 고객은 사기 통화의 19%가 온라인 뱅킹에 접근하기 위한 것이었다고 보고했습니다. 제너러티브 AI와 딥페이크의 증가로, 이러한 공격은 더 강력하고 확장 가능해졌습니다. 이제 한두 명의 사기꾼이 가라지에서 합성 음성을 만들고 여러 금융 기관에 동시 공격을 할 수 있습니다. 이것은 소비자에게 금융 부문이 이러한 복잡한 공격에 대비할 준비가 되었는지에 대한 우려를 높입니다.
제너러티브 AI의 발전이 딥페이크의 증가에 어떻게 기여했으며, 이러한 기술은 보안 시스템에 어떤 특정한 도전을 제기합니까?
딥페이크는 새로운 것이 아니지만, 제너러티브 AI의 발전은 지난 1년 동안 대규모로 믿을 수 있는 음성을 생성할 수 있게 해주었습니다. 제너러티브 AI의 발전은 대규모 언어 모델이 더 믿을 수 있는 음성과 언어를 생성할 수 있게 해주었습니다. 이제 자연스러운 합성 음성(가짜 음성)을 저렴하게 생성할 수 있습니다. 이러한 발전은 딥페이크를 모든 사람에게, 사기꾼을 포함하여, 접근할 수 있게 해주었습니다. 이러한 딥페이크는 보안 시스템에 도전을 제기합니다. 그것은 매우 믿을 수 있는 피싱 공격, 잘못된 정보의 확산, 금융 사기 등을 가능하게 합니다. 그것은 전통적인 인증 방법을 무효화하고, 상당한 평판 위험을 만들며, 빠르게 발전하는 딥페이크를 따라잡기 위해 고급 탐지 기술이 필요합니다.
핀드롭 펄스는 바이든 대통령 로보콜 공격에서 사용된 TTS 엔진을 식별하는 데 어떻게 기여했으며, 이것은 미래의 딥페이크 탐지에 어떤 의미를 가집니까?
핀드롭 펄스는 바이든 대통령 로보콜 공격에서 사용된 TTS 엔진을 식별하는 데 중요한 역할을 했습니다. 우리는 고급 딥페이크 탐지 기술을 사용하여 4단계 분석 과정을 구현했습니다. 이는 오디오 필터링 및 정화, 특징 추출, 세그먼트 분석, 연속적인 점수를 포함합니다. 이 과정은 비음성 프레임을 필터링하고, 오디오를 다운샘플링하여 일반적인 전화 조건을 복제하고, 저수준의 분광-시간 특징을 추출하는 것을 허용했습니다.
오디오를 155개의 세그먼트로 나누고 라이브니스 점수를 할당함으로써, 우리는 오디오가 일관되게 인공적인 것으로 결정했습니다. “가짜 인식”을 사용하여, 우리는 오디오를 122개의 TTS 시스템과 비교하고, 99%의 가능성으로 ElevenLabs 또는 유사한 시스템이 사용되었다고 식별했습니다. 이 발견은 ElevenLabs SpeechAI Classifier를 통해 84%의 가능성으로 검증되었습니다. 우리의 자세한 분석은 특히 부드러운 자음과 드문 표현이 포함된 구절에서 딥페이크 인공물질을 발견했습니다.
보고서에서는 딥페이크가 미디어 및 정치 기관에 미치는 영향에 대한 우려를 언급합니다. 이러한 사건의 예를 제공할 수 있습니까?
우리의 연구에 따르면, 미국 소비자는 은행 및 금융 부문에서 딥페이크와 음성 클론에 대한 위험에 가장 우려합니다. 그러나 그 외에도, 미디어 및 정치 기관에 대한 딥페이크의 위협은 상당한 도전을 제기합니다. 미국 외에도, 인도네시아(수하르토 딥페이크)와 슬로바키아(미칼 시메카와 모니카 토도바 음성 딥페이크)에서 딥페이크의 사용이 관찰되었습니다.
핀드롭은 딥페이크와 합성 음성을 실시간으로 탐지하는 데 사용하는 기술과 방법론은 무엇입니까?
핀드롭은 딥페이크와 합성 음성을 실시간으로 탐지하는 데 다양한 고급 기술과 방법론을 사용합니다. 이는 다음을 포함합니다:
-
- 라이브니스 감지: 핀드롭은 대규모 기계 학습을 사용하여 비음성 프레임(예: 침묵, 노이즈, 음악)과 인공 음성과 일반적인 인간 음성을 구별하는 저수준의 분광-시간 특징을 추출합니다.
- 오디오 지문: 이는 각 음성의 음향 특성(예: 피치, 톤, 캐드نس)에 따라 디지털 서명을 생성하는 것을 포함합니다. 이러한 서명은 음성을 비교하고 일치시키는 데 사용됩니다.
- 행동 분석: 이는 이상한 행동 패턴을 분석하는 것을 포함합니다. 이는 비정상적인 접근, 빠른 봇 활동, 계정 탐색, 데이터 마이닝, 로봇 다이얼링을 포함합니다.
- 음성 분석: 전통적인 음성 생체 인증 시스템은 딥페이크 공격에 취약합니다. 이를 강화하기 위해, 음성 불일치 및 음성 미스매치와 같은 새로운 기술이 필요합니다. 이러한 기술은 여러 음성, 반복되는 호출, 위협이 될 수 있는 다른 소리가 들리는 음성을 인식하고 구별하는 추가적인 방어 계층을 제공합니다.
- 다층 보안 접근 방식: 이는 다양한 탐지 방법을 결합하여 결과를 교차 확인하고 탐지 정확도를提高하는 것을 포함합니다. 예를 들어, 오디오 지문 결과는 생체 인증과 함께 교차 확인하여 의심을 확인할 수 있습니다.
- 계속적인 학습 및 적응: 핀드롭은 지속적으로 모델과 알고리즘을 업데이트합니다. 이는 새로운 데이터를 통합하고, 탐지 기술을 개선하며, 새로운 위협에 대비하는 것을 포함합니다. 계속적인 학습은 탐지 능력이 시간이 지남에 따라 개선되고, 새로운 합성 음성 공격에 적응하는 것을 보장합니다.
펄스 딥페이크 보증은 무엇이며, 핀드롭의 딥페이크 위협 대응 능력에 대한 고객의 신뢰를 어떻게 향상시킵니까?
펄스 딥페이크 보증은 첫 번째 보증으로, 연락 센터의 합성 음성 사기에 대한 보상을 제공합니다. 사이버 공격 풍경이剧적으로 변화하는 상황에서, 2025년까지 잠재적인 금융 손실은 10.5조 달러로 증가할 것으로 예상됩니다., 펄스 딥페이크 보증은 고객의 신뢰를 높이는 데 몇 가지 주요 이점을 제공합니다:
- 신뢰 향상: 펄스 딥페이크 보증은 핀드롭의 제품과 기술에 대한 자신감을 보여주며, 고객에게 신뢰할 수 있는 보안 솔루션을 제공합니다.
- 손실 보상: 핀드롭 고객은 핀드롭 제품 스위트에 의해 탐지되지 않은 합성 음성 사기 사건에 대한 보상을 받을 수 있습니다.
- 계속적인 개선: 핀드롭 고객의 요청은 보증 프로그램을 통해 받으며, 핀드롭은 합성 음성 사기 전략의 발전에 대비하여 계속 개선할 수 있습니다.
핀드롭의 기술이 성공적으로 딥페이크 위협을 완화한 유명한 사례 연구가 있습니까? 결과는 무엇입니까?
파이크스빌 고등학교 사건: 2024년 1월 16일, 파이크스빌 고등학교의 교장이 कथ적으로 인스타그램에 올라온 녹음이 발견되었습니다. 이 오디오에는 흑인 학생과 교사에 대한 모욕적인 발언이 포함되어 있었으며, 이는 대중의 격렬한 반발과 심각한 우려를 불러일으켰습니다.
이러한 개발의 빛에서, 핀드롭은 철저한 조사에 착수하여 세 가지 독립적인 분석을 수행하여 진실을 밝히기 위해 노력했습니다. 우리의 조사 결과는 다음과 같은 결론을 내리게 했습니다. 1월 오디오는 변경되었지만, AI 생성 음성의 명확한 특징이 없었습니다. 우리의 조사 결과는 97%의 확신을 제공했습니다. 이 중요한 발견은 조작된 미디어의 본질에 대한 공표 전에 자세한 분석을 수행하는 중요성을 강조합니다.
독립적인 NPR 오디오 딥페이크 실험: 디지털 보안은 사기꾼과 보안 기술 제공자 간의 끊임없는 암흑 전쟁입니다. 핀드롭을 포함한 여러 제공업체가 일관되게 오디오 딥페이크를 탐지한다고 주장했지만, NPR는 이러한 주장을 테스트하여 현재 기술 솔루션이 일관되게 AI 생성 오디오 딥페이크를 탐지할 수 있는지 평가했습니다.
핀드롭 펄스는 84개의 오디오 샘플 중 81개를 정확하게 탐지하여 96.4%의 정확도를 달성했습니다. 또한, 핀드롭 펄스는 모든 딥페이크 샘플을 100% 탐지했습니다. 다른 제공업체도 이 연구에서 평가되었지만, 핀드롭은 딥페이크와 실제 오디오를 모두 신뢰성 있게 탐지할 수 있는 기술을 보유하고 있음을 보여주었습니다.
음성 기반 사기 및 보안의 미래 트렌드는 무엇이며, 특히 AI 기술의 빠른 발전에 따라 어떻게 준비하고 있습니까?
우리는 2024년에 연락 센터 사기가 계속 증가할 것으로 예상합니다. 금융 부문에 걸쳐 사기율을 분석한 결과, 현재 수준보다 4-5% 증가하여 1년 말에는 연락 센터에 걸려오는 모든 730통의 통화 중 1통이 사기일 것으로 예상됩니다. 대부분의 증가한 사기는 은행 부문에 영향을 미칠 것으로 예상되며, 보험, 중개, 기타 금융 부문은 현재 수준을 유지할 것으로 예상됩니다. 우리는 이러한 사기율이 미국의 금융 기관에 대한 사기 노출을 70억 달러로 나타낼 것으로 예상합니다. 그러나 우리는 특히 사기꾼이 IVR을 테스트 장소로 사용하는 것으로 예상합니다. 최근에, 우리는 사기꾼이 개인 정보(PII)를 수동으로 입력하여 계정 세부 정보를 확인하는 것을 관찰했습니다. 이러한 사기율은 금융 기관에 대한 사기 노출을 나타내며, 이를 방지하기 위해 우리는 계속해서 핀드롭의 현재 솔루션을 발전시키고, 새로운 혁신적인 도구를 출시할 것입니다.
현재 기술을 넘어서, 음성 사기 방지 및 인증을 강화하기 위한 새로운 도구와 기술은 무엇입니까?
음성 사기 방지 및 인증 기술은 기술의 발전과 사기 활동의 복잡성에 따라 지속적으로 발전하고 있습니다. 이러한 기술에는 다음이 포함됩니다:
- 계속적인 사기 탐지 및 조사: 이는 새로운 정보가 사용 가능해질 때마다 사기 사례에 대한 역사적인 “돌아보기”를 제공합니다. 이 접근 방식은 사기 분석가가 새로운 사기 신호를 “들어”보고, 관련된 이전 통화를 스캔하며, 이러한 통화를 재평가할 수 있습니다. 이는 회사에 사기에 대한 지속적이고 포괄적인 관점을 제공합니다.
- 지능형 음성 분석: 전통적인 음성 생체 인증 시스템은 딥페이크 공격에 취약합니다. 이를 강화하기 위해, 음성 불일치 및 음성 미스매치와 같은 새로운 기술이 필요합니다. 이러한 기술은 여러 음성, 반복되는 호출, 위협이 될 수 있는 다른 소리가 들리는 음성을 인식하고 구별하는 추가적인 방어 계층을 제공합니다.
- 초기 사기 탐지: 사기 탐지 기술은 통화 초기에 빠르고 신뢰할 수 있는 사기 신호를 제공하는 것입니다. 라이브니스 감지 외에도, 캐리어 메타데이터 분석, 발신자 ID 스푸핑 탐지, 오디오 기반 스푸핑 탐지는 대화의 시작 부분에 방어를 제공합니다.
이 인터뷰에 감사드립니다. 더 많은 정보를 위해 핀드롭의 2024년 음성 지능 및 보안 보고서를 읽거나 핀드롭을 방문하십시오.












