نماذج ومنصات الذكاء الاصطناعي
فيجاي بالاسوبرامانيان، المؤسس المشارك والرئيس التنفيذي لشركة Pindrop – سلسلة المقابلات

فيجاي بالاسوبرامانيان هو المؤسس المشارك والرئيس التنفيذي لشركة Pindrop. وقد شغل مناصب هندسية وبحثية مختلفة في جوجل وسيمنز وآي بي إم ريسيرش وإنتل.
Pindrop‘s solutions هي الرائدة في مستقبل الصوت من خلال إنشاء معيار الهوية والأمان والثقة لكل تفاعل صوتي. تحمي حلول Pindrop بعض أكبر البنوك والتأمين والمتاجر باستخدام تقنيات محمية بالبراءات التي تستخرج المعلومات من كل مكالمة وصوت يتم مواجهته. تساعد حلول Pindrop في الكشف عن المخادعين وتحقق العملاء الحقيقيين، مما يقلل من الاحتيال والتكاليف التشغيلية مع تحسين تجربة العملاء وحماية سمعة العلامة التجارية. Pindrop، شركة خاصة مقرها أتلانتا، جورجيا، تأسست في 2011 من قبل الدكتور فيجاي بالاسوبرامانيان، والدكتور بول جUDGE، والدكتور موستاك أحمد، وتمت تمويلها من قبل Andreessen Horowitz وCiti Ventures وFelicis Ventures وCapitalG وGV وIVP وVitruvian Partners. لمزيد من المعلومات، يرجى زيارة pindrop.com.
ما هي النتائج الرئيسية من تقرير Pindrop 2024 حول ذكاء الصوت والأمان بشأن حالة الاحتيال والامن القائم على الصوت الحالية؟
يقدم التقرير تحليلًا عميقًا للمسائل الأمنية الحالية والاتجاهات المستقبلية، خاصة في مراكز الاتصال التي تخدم المؤسسات المالية وغير المالية. تشمل النتائج الرئيسية في التقرير ما يلي:
- زيادة كبيرة في احتيال مركز الاتصال: ازداد احتيال مركز الاتصال بنسبة 60٪ خلال السنوات القليلة الماضية، ووصل إلى أعلى مستوياته منذ 2019. ومن المتوقع أن يكون كل مكالمة من كل 730 مكالمة إلى مركز اتصال احتيالية بحلول نهاية هذا العام.
- زيادة تعقيد المهاجمين الذين يستخدمون Deepfake: ازدادت هجمات Deepfake، بما في ذلك النسخ الصوتية الاصطناعية المتقدمة، وتمثل خطر احتيال يقدر ب 5 مليارات دولار على مراكز الاتصال في الولايات المتحدة. يتم استخدام هذه التقنية لتعزيز أساليب الاحتيال مثل الاستطلاع التلقائي والهجوم على نطاق واسع والتصوير الصوتي والهندسة الاجتماعية.
- أنه لا تعمل طرق الكشف عن الاحتيال والتأكيد التقليدية: لا تزال الشركات تعتمد على التأكيد اليدوي للمستهلكين وهو ما يستهلك وقتًا ويكون باهظًا وغير فعال في وقف الاحتيال. 350 مليون ضحية من انتهاكات البيانات. 12 مليار دولار يتم إنفاقها سنويًا على التأكيد و10 مليارات دولار يتم فقدانها بسبب الاحتيال هي دليل على أن الأساليب الأمنية الحالية لا تعمل.
- تتطلب نهجًا جديدًا وتقنيات: الكشف عن الحية هو أمر بالغ الأهمية لمكافحة الذكاء الاصطناعي السيئ وتعزيز الأمان. لا تزال تحليل الصوت مهمًا ولكن يجب ربطه بالكشف عن الحية والتأكيد المتعدد.
وفقًا للتقرير، فإن 67.5٪ من المستهلكين الأمريكيين قلقون من Deepfakes في قطاع البنوك. هل يمكن أن تشرح أنواع تهديدات Deepfakes التي تواجهها المؤسسات المالية؟
ازداد الاحتيال المصرفي عبر قنوات الهاتف بسبب عدة عوامل. نظرًا لأن المؤسسات المالية تعتمد بشكل كبير على العملاء لتأكيد النشاط المشبوه، يمكن أن تصبح مراكز الاتصال أهدافًا رئيسية للمخادعين. يستخدم المخادعون أساليب الهندسة الاجتماعية لخداع ممثلي خدمة العملاء، مما يؤدي إلى إزالة القيود أو مساعدة إعادة تعيين بيانات تسجيل الدخول عبر الإنترنت. وفقًا لعميل بنكي واحد من Pindrop، كان 36٪ من مكالمات الاحتيال المعروفة تهدف في المقام الأول إلى إزالة المضايقات التي فرضها ضوابط الاحتيال. وتقارير عميل بنكي آخر من Pindrop أن 19٪ من مكالمات الاحتيال تهدف إلى الحصول على وصول إلى البنك عبر الإنترنت. مع ظهور الذكاء الاصطناعي والتعلم العميق، أصبحت هذه الهجمات أكثر قوة ومدى.
كيف ساهمت التطورات في الذكاء الاصطناعي في زيادة Deepfakes، وما هي التحديات المحددة التي تطرحها هذه الهجمات على أنظمة الأمان؟
على الرغم من أن Deepfakes ليست جديدة، إلا أن التطورات في الذكاء الاصطناعي جعلتها قوة قوية خلال العام الماضي لأنها أصبحت أكثر واقعية على نطاق أوسع. جعلت التطورات في GenAI النماذج اللغة الكبيرة أكثر ملاءمة لإنشاء كلام و لغة واقعية. يمكن الآن إنشاء كلام اصطناعي طبيعي بسهولة وبتكلفة منخفضة. هذه التطورات جعلت Deepfakes متاحة للجميع، بما في ذلك المخادعين. هذه Deepfakes تطرح تحديات لأنظمة الأمان من خلال تمكين هجمات الفишينج القناعية، وانتشار المعلومات الخاطئة، وتسهيل الاحتيال المالي من خلال التمثيلات الواقعية. إنها تهدد أساليب التأكيد التقليدية، وتخلق مخاطر سمعة كبيرة، وتطالب بتكنولوجيا الكشف المتقدمة للبقاء متقدمًا على تطورها السريع.
كيف ساهم Pindrop Pulse في تحديد محرك TTS المستخدم في هجوم المكالمة الهاتفية للرئيس بايدن، وما هي الآثار التي تترتب على ذلك بالنسبة لاكتشاف Deepfakes في المستقبل؟
لعب Pindrop Pulse دورًا حاسمًا في تحديد ElevenLabs، محرك TTS المستخدم في هجوم المكالمة الهاتفية للرئيس بايدن. باستخدام تقنيتنا المتقدمة لاكتشاف Deepfakes، نفذنا عملية تحليل تتألف من أربع مراحل تشمل تصفية الصوت وتحليل القطاعات وتقييم مستمر. هذه العملية سمحت لنا بتصفية الإطارات غير الصوتية وتقليل الصوت إلى تكرار ظروف الهاتف وتحليل الميزات الطيفية الزمنية منخفضة المستوى.
من خلال تقسيم الصوت إلى 155 قطاعًا وتحديد درجات الحية، قمنا بتأكيد أن الصوت كان اصطناعيًا باستمرار. باستخدام “fakeprints”، قارنا الصوت مع 122 نظام TTS وتحديدًا ElevenLabs أو نظام مشابه بفرصة 99٪. تم التحقق من هذا الاكتشاف بفرصة 84٪ من خلال مصنف SpeechAI من ElevenLabs. كشفت تحليلنا المتعمق عن أثار Deepfakes، خاصة في العبارات الغنية بالصوت والتعابير غير المألوفة للرئيس بايدن.
هل هناك أي دراسات حالة ملحوظة حيث نجحت تقنيات Pindrop في التخفيف من تهديدات Deepfakes؟ ما كانت النتائج؟
حادث مدرسة بايكسفيل الثانوية: في 16 يناير 2024، ظهر تسجيل على إنستجرام يُزعم أنه يحتوي على مدير مدرسة بايكسفيل الثانوية في بالتيمور، ماريلاند. تحتوي الصوت على تعليقات منفرة حول الطلاب والمعلمين السود، مما أثار عاصفة من الغضب العام والقلق الجاد.
في ضوء هذه التطورات، قامت Pindrop بتحقيق شامل، وأجرت ثلاثة تحليلات مستقلة للكشف عن الحقيقة. أدت نتائج تحقيقنا الشامل إلى استنتاج دقيق: على الرغم من أن الصوت في يناير تم تعديله، إلا أنه يفتقر إلى الميزات الواضحة للكلام الاصطناعي الذي يتم إنشاؤه بواسطة الذكاء الاصطناعي. يعتمد ثقتنا في هذا التحديد على ثقة بنسبة 97٪ بناءً على معايير تحليلنا.
ما هي الاتجاهات المستقبلية في الاحتيال والامن القائم على الصوت التي تتوقعها، خاصة مع التطور السريع لتكنولوجيا الذكاء الاصطناعي؟ وكيف تستعد Pindrop لمواجهة هذه التحديات؟
نحن نتوقع أن يستمر احتيال مركز الاتصال في الارتفاع في 2024. بناءً على تحليل الاحتيال عبر القطاعات، نحصل على تقدير احتياطي لاحتيال بنسبة 1 من كل 730 مكالمة، مما يمثل زيادة بنسبة 4-5٪ عن المستويات الحالية.
من المتوقع أن يؤثر معظم الاحتيال على قطاع البنوك، في حين من المتوقع أن يبقى قطاع التأمين والوساطة وغيرها من القطاعات المالية على مستوياتها الحالية. نحصل على تقدير لاحتيال يصل إلى 7 مليارات دولار للمؤسسات المالية في الولايات المتحدة، والتي يجب حمايةها. ومع ذلك، نتوقع تحولًا كبيرًا، خاصةً مع احتيال يستخدم نظام الرد التلقائي كأرض اختبار. لقد لاحظنا مؤخرًا زيادة في الاحتيال الذين يقومون بتحميل المعلومات الشخصية بشكل يدوي لتأكيد تفاصيل الحساب.
ما هي الأدوات والتقنيات الجديدة التي يتم تطويرها لتعزيز منع الاحتيال وتأكيد الصوت؟
تطوير تقنيات منع الاحتيال وتأكيد الصوت لا يزال مستمرًا لمواكبة التطورات في التكنولوجيا وتعقيد النشاط الاحتيالي. تشمل بعض الأدوات والتقنيات الناشئة ما يلي:
- الكشف المستمر عن الاحتيال والتحقيق: يوفر نظرة históريكة على حالات الاحتيال مع المعلومات الجديدة المتاحة الآن. مع هذا النهج، يمكن لمحللين الاحتيال “استماع” إلى إشارات احتيال جديدة، مسح المكالمات التاريخية التي قد تكون ذات صلة، وإعادة تصنيف تلك المكالمات.
- التحليل الذكي للصوت: أنظمة البصمات الصوتية التقليدية عرضة للهجمات Deepfake. لتعزيز دفاعاتها، هناك حاجة إلى تقنيات جديدة مثل Voice Mismatch وNegative Voice Matching. توفر هذه التقنيات طبقة إضافية من الدفاع من خلال التعرف على وتفريق الأصوات المتعددة والمتكررة والتعرف على الأصوات التي قد تشكل تهديدًا.
- الكشف المبكر عن الاحتيال: تقنيات الكشف عن الاحتيال التي توفر إشارة احتيال سريعة وموثوقة في بداية عملية المكالمة هي لا تقدر بثمن. بالإضافة إلى الكشف عن الحية، تقنيات مثل تحليل البيانات من مشغل الهاتف والكشف عن التزوير الصوتي توفر حماية ضد هجمات الاحتيال في بداية المحادثة عندما تكون الدفاعات أكثر ضعفًا.
شكرًا على المقابلة الرائعة، لمزيد من المعلومات اقرأ تقرير Pindrop 2024 حول ذكاء الصوت والأمان أو زور Pindrop.












