Mô hình và nền tảng AI

Làm thế nào để Phát hiện Audio Deepfakes

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Audio deepfakes nghe gần như giống hệt với người thật, đôi khi thậm chí là những người bạn biết. Chỉ cần vài giây ghi âm để tái tạo chính xác giọng nói và nhịp điệu của một người với các công cụ nhân bản giọng nói hiện đại được hỗ trợ bởi các mô hình học máy. Những gì trước đây nghe có vẻ như robot hoặc phẳng bây giờ nghe có cảm xúc và tự nhiên, bao gồm cả mẫu thở và giọng nói.

Trong khi sự tiến bộ này thúc đẩy các ứng dụng sáng tạo như trợ lý ảo và kể chuyện dễ tiếp cận, nó cũng mở ra cánh cửa cho các rủi ro nghiêm trọng. Phát hiện audio deepfakes quan trọng vì giọng nói của bạn là một phần của danh tính của bạn. Một khi nó có thể được nhân bản, niềm tin vào giao tiếp kỹ thuật số sẽ giảm đi. Học cách nhận biết âm thanh giả vượt quá việc bảo vệ bạn khỏi các trò lừa đảo và thông tin sai lệch. Nó liên quan đến việc bảo vệ tính xác thực của mọi cuộc trò chuyện bạn có trực tuyến.

Tác động của Audio Deepfakes đối với Xã hội và An ninh

Audio deepfakes đã làm cho việc tin tưởng vào những gì bạn nghe trực tuyến hoặc qua điện thoại trở nên khó khăn hơn. Khi giọng nói của một người có thể được nhân bản chỉ với vài giây âm thanh, thậm chí cả giọng nói quen thuộc cũng có thể được sử dụng để lừa dối. Những kẻ lừa đảo ngày càng sử dụng giọng nói tổng hợp để giả mạo các CEO, đồng nghiệp và thành viên trong gia đình — thuyết phục nạn nhân chuyển tiền hoặc chia sẻ dữ liệu bí mật.

Những trò lừa đảo này gây ra thiệt hại tài chính và xói mòn niềm tin vào các cuộc trò chuyện kỹ thuật số. Đối với các doanh nghiệp, rủi ro vượt ra ngoài tiền bạc đến uy tín và niềm tin của khách hàng. Các đội ngũ thực thi pháp luật và an ninh mạng kết hợp các công cụ pháp y, hệ thống xác thực giọng nói và các mô hình phát hiện AI để chống lại những mối đe dọa này. Tuy nhiên, khi công nghệ deepfake phát triển, việc luôn cảnh giác và thông tin là phương phòng thủ tốt nhất của bạn chống lại sự lừa dối trong một thế giới nơi giọng nói có thể nói dối.

7 Mẹo để Xác định Audio Deepfakes

Ngay cả những audio deepfakes tốt nhất cũng để lại những manh mối tinh vi. Bạn có thể phát hiện sự thao túng trước khi nó gây hại bằng cách chú ý đến các chi tiết trong chất lượng âm thanh, nhịp điệu nói và hành vi ngữ cảnh. Dưới đây là 10 mẹo thực tế để giúp phát hiện âm thanh tổng hợp hoặc bị thao túng.

1. Nghe các Dừng lại hoặc Chuyển tiếp Không Tự Nhiên

Giọng nói được tạo ra bởi AI có thể nghe có vẻ thật, nhưng bạn sẽ thường bắt được những manh mối nhỏ nếu bạn nghe kỹ. Những manh mối này bao gồm một khoảng dừng cảm thấy không tự nhiên, một nhịp điệu slightly lệch hoặc một giọng nói thay đổi giữa câu. Những bất thường nhỏ về thời gian này là những dấu hiệu cho thấy có gì đó không hoàn toàn con người. Tuy nhiên, ngay cả với những gợi ý đó, việc phát hiện audio deepfake không dễ dàng.

Nghiên cứu cho thấy bạn chỉ có thể phát hiện chúng với độ chính xác khoảng 62%, điều đó có nghĩa là gần một nửa thời gian, một bản sao giả có thể trượt qua bạn. Khi các deepfakes trở nên tinh vi hơn, điều thông minh là xác minh lại các tin nhắn đáng ngờ, đặc biệt là khi chúng liên quan đến thông tin nhạy cảm hoặc yêu cầu khẩn cấp. Việc xác minh nhanh có thể cứu bạn khỏi việc sa vào một giọng nói nghe có vẻ thật nhưng không phải.

2. Để ý sự Phẳng hoặc Tăng cường Cảm xúc

Khi bạn nghe một audio deepfake, bạn có thể nhận thấy có gì đó hơi khác thường về giọng nói của người nói. Deepfakes thường nghe quá đơn điệu — thiếu sự lên xuống tự nhiên của cảm xúc con người — hoặc quá cường điệu, với sự nhấn mạnh không phù hợp với ngữ cảnh.

Các mô hình AI có thể bắt chước cao độ và nhịp điệu nhưng gặp khó khăn trong việc bắt捉 sự cân bằng cảm xúc tinh vi trong các cuộc trò chuyện thực. Nếu giọng nói nghe có vẻ quá phẳng hoặc quá kịch tính, đặc biệt là trong những khoảnh khắc nên cảm thấy bình thường, hãy coi đó là một tín hiệu cảnh báo. Việc chú ý đến những bất thường về giọng điệu này có thể giúp bạn phát hiện âm thanh giả trước khi nó thuyết phục bạn hành động trên điều gì đó không thực.

3. Xem xét các Hiện tượng Âm thanh

Những manh mối tinh vi — tĩnh lặng nhẹ, biến dạng kỳ lạ hoặc thay đổi cao độ đột ngột không nghe có vẻ đúng — có thể tiết lộ một audio deepfake. Những lỗi nhỏ này xảy ra vì các hệ thống AI ghép các mảnh âm thanh lại với nhau để bắt chước giọng nói tự nhiên. Điều gì đó đáng ngạc nhiên hơn là lượng âm thanh mà những công cụ này cần để tạo ra một bản sao giọng nói thuyết phục của bạn.

Trong một số trường hợp, chỉ cần ba giây âm thanh ghi lại là đủ để tạo ra sự khớp giọng nói 85% giữa bạn và bản sao giả. Điều đó có nghĩa là một đoạn ngắn từ một tin nhắn voicemail, một bài đăng trên mạng xã hội hoặc một đoạn video ngắn có thể là tất cả những gì cần thiết để ai đó sao chép giọng điệu và nhịp điệu của bạn. Bất cứ khi nào có gì đó nghe có vẻ hơi khác thường, hãy tin vào trực giác của bạn. Những khiếm khuyết nhỏ này có thể là những dấu hiệu duy nhất cho thấy giọng nói bạn đang nghe không phải là thật.

4. So sánh với Các Bản Ghi âm đã Biết

Giọng nói thật có một dòng chảy tự nhiên mà AI vẫn còn khó bắt chước hoàn toàn. Khi một người nói, giọng điệu, nhịp điệu và hơi thở của họ nhất quán phản ánh tính cách và cảm xúc của họ. Bạn thường có thể nghe thấy những manh mối tinh vi — một hơi thở nhanh trước một ý nghĩ, một nhịp điệu ổn định khi họ bình tĩnh hoặc một sự thay đổi nhỏ trong nhịp điệu — khi họ nhấn mạnh một điểm.

Audio deepfakes, mặt khác, thường bỏ lỡ những chi tiết hữu cơ này. Việc thở có thể nghe có vẻ máy móc, nhịp điệu không đều, hoặc giọng điệu nghe quá phẳng hoặc quá cường điệu. Nếu giọng nói nghe quá mượt mà hoặc thiếu những khiếm khuyết nhỏ của con người, đó là một dấu hiệu cho thấy nó có thể là tổng hợp. Việc chú ý đến cách một người nói tự nhiên giúp bạn nhận ra khi một giọng nói không nghe giống họ.

5. Sử dụng Xác minh Đa kênh

Khi một tin nhắn giọng nói hoặc cuộc gọi cảm thấy đáng ngờ, hãy luôn dành một chút thời gian để xác minh nó trước khi phản hồi. Cách dễ nhất để giữ an toàn là xác nhận tin nhắn thông qua một kênh khác — gửi một tin nhắn ngắn, tham gia một cuộc gọi video hoặc trả lời bằng một địa chỉ email chính thức mà bạn tin cậy. Bước xác minh này có thể bảo vệ bạn khỏi các trò lừa đảo sử dụng giọng nói nhân bản và sự cấp bách giả để lừa bạn hành động nhanh.

Ngày nay, những kẻ lừa đảo mạng trở nên thông minh hơn, kết hợp audio deepfakes với lừa đảo giọng nói để đánh cắp dữ liệu. Đó là một mối đe dọa ngày càng tăng, với 71% các tổ chức báo cáo họ đã phải đối mặt với những nỗ lực này. Đó là lý do tại sao việc kiểm tra lại giao tiếp là một thói quen thông minh. Khi có gì đó cảm thấy không đúng, hãy tin vào xác minh hơn là sự cấp bách và dành thời gian để xác nhận sự thật trước khi hành động.

6. Kiểm tra Ngữ cảnh Nói

Khi bạn nhận được một cuộc gọi hoặc tin nhắn giọng nói không mong muốn, hãy chú ý đến cả nội dung được nói cũng như cách nó nghe. Các trò lừa đảo deepfake thường dựa vào cách nói không bình thường, sự cấp bách đột ngột hoặc yêu cầu dữ liệu nhạy cảm để gây áp lực cho bạn hành động nhanh. Bạn có thể nghe thấy một giọng nói tuyên bố là sếp của bạn yêu cầu chuyển tiền ngay lập tức, hoặc một người thân yêu nghe có vẻ khó chịu và yêu cầu giúp đỡ — cả hai đều là chiến thuật phổ biến mà những kẻ lừa đảo sử dụng.

Những kích thích cảm xúc này khiến bạn hoảng loạn trước khi suy nghĩ mọi thứ qua. Nếu một tin nhắn cảm thấy vội vàng, đáng ngờ hoặc hơi không phù hợp, hãy bước lại và xác minh nó thông qua một kênh khác. Một khoảng dừng ngắn để xác minh có thể ngăn chặn một giọng nói giả dẫn đến một vấn đề thực sự.

7. Tùy thuộc vào Các Công cụ Xác minh Tin cậy

Các công cụ phát hiện âm thanh AI và phần mềm pháp y đang trở thành những công cụ thiết yếu để phát hiện deepfakes. Những công nghệ này phân tích sóng âm, tiếng ồn nền và mẫu nói để xác định những dấu hiệu tinh vi của sự thao túng mà tai người có thể dễ dàng bỏ lỡ. Mặc dù bạn có thể tin vào trực giác của mình, các nghiên cứu cho thấy rằng quan điểm con người không phải lúc nào cũng đáng tin cậy — ngay cả những người nghe được đào tạo cũng có thể bị lừa bởi các bản sao giọng nói rất thực.

Tùy thuộc vào trực giác một mình không còn đủ nữa. Các hệ thống phát hiện mạnh mẽ là cần thiết để giúp cá nhân, doanh nghiệp và các đội an ninh xác minh điều gì là thật và điều gì là giả. Khi công nghệ deepfake phát triển, việc kết hợp phát hiện tự động với tư duy批判 có thể bảo vệ giao tiếp, danh tiếng và niềm tin trong thế giới kỹ thuật số.

Luôn Cảnh giác, Luôn được Thông tin

Ngay cả khi công nghệ deepfake được cải thiện, khả năng nghe một cách批判 và đặt câu hỏi về những gì bạn nghe vẫn là một phương tiện phòng thủ mạnh mẽ. Chú ý đến những manh mối tinh vi và xác minh thông tin thông qua các kênh tin cậy có thể ngăn chặn sự thao túng trước khi nó lan rộng. Việc luôn cảnh giác và hoài nghi giúp bạn bảo vệ dữ liệu của mình và niềm tin mà giữ cho giao tiếp kỹ thuật số trở nên xác thực.

Zac Amos là một nhà viết về công nghệ tập trung vào trí tuệ nhân tạo. Ông cũng là Biên tập viên Đặc sắc tại ReHack, nơi bạn có thể đọc thêm về công việc của ông.