مقابلات

أور لينتشنر، الرئيس التنفيذي لشركة Bright Data – سلسلة المقابلات

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

أور لينتشنر، الرئيس التنفيذي لشركة Bright Data، يقود منصة جمع البيانات على الويب الرائدة في السوق منذ عام 2018، مما أدى إلى توسيعها وابتكارها ونموها إلى أكثر من 100 مليون دولار في الإيرادات السنوية. Bright Data تمكن الشركات من فورتشن 500 والشركات الرائدة والجامعات المعروفة والكيانات الحكومية من الوصول إلى البيانات العامة على الويب في الوقت الفعلي وبالحجم الكافي. لينتشنر هو مدافع قوي عن إبقاء البيانات العامة على الويب مفتوحة ويمكن الوصول إليها، وشدد على دورها الحاسم في دفع الابتكار.

ما هو ما ألهم رحلتك في عالم البيانات والذكاء الاصطناعي، ومنذ أن أصبحت الرئيس التنفيذي في عام 2018، كيف قمت بتشكيل مهمة ورسالة Bright Data؟

لقد كنت دائمًا مهتمًا بقوة البيانات، وخاصة بالطريقة التي يمكن أن تقود بها القرارات وتغذي الابتكار. عندما تستخدم بشكل صحيح، يمكن أن تقود البيانات أيضًا الشفافية في الأعمال. أصبحت الرئيس التنفيذي لشركة Bright Data في عام 2018، وأعطيتني الفرصة لمساعدة في تشكيل كيفية عمل باحثي الذكاء الاصطناعي والشركات في جمع البيانات العامة على الويب.

ما هي التحديات الرئيسية التي تواجه فرق الذكاء الاصطناعي في جمع البيانات العامة على الويب على نطاق واسع، وكيف تعالج Bright Data هذه التحديات؟

التناسبية لا تزال واحدة من أكبر التحديات التي تواجه فرق الذكاء الاصطناعي. منذ أن تتطلب نماذج الذكاء الاصطناعي كميات هائلة من البيانات، فإن جمعها بفعالية ليس بالأمر الصغير. كما أن نماذج الذكاء الاصطناعي ليست أفضل من البيانات التي تم تدريبها عليها، لذلك تأكيد أن الفرق لديها إمكانية الوصول إلى بيانات جديدة وذات جودة عالية هو تحد دائم.

هناك قلق كبير آخر هو الامتثال. قوانين ومتطلبات الخصوصية تطور باستمرار، لذلك يجب على فرق الذكاء الاصطناعي أن تكون على دراية دائمة بتلك التغييرات. كما يجب أن تفهم كيفية التعامل مع المواقع التي تفرض آليات反ية، مما يمكن أن ي complicate عملية جمع البيانات.

المنصة التي بنيناها في Bright Data تتعامل مع هذه التحديات. نقدم جمع بيانات آلي ومتوافق يُقدم بيانات حقيقية في الوقت الفعلي. أدواتنا مدعومة بالذكاء الاصطناعي لتنظيف وتحقق البيانات لضمان الدقة. لدينا إجراءات صارمة لضمان جمع البيانات بشكل قانوني واخلاقي للامتثال. الفكرة هي تمكين فرق الذكاء الاصطناعي من التركيز على بناء نماذج رائعة، في حين نتعامل مع تعقيدات جمع البيانات.

كيف تساهم البيانات عالية الجودة في أداء نموذج الذكاء الاصطناعي، وما هي أفضل الممارسات لضمان دقة البيانات؟

البيانات عالية الجودة تعني البيانات التي تكون كاملة وخالية من التحيزات وأهم من ذلك دقيقة. إذا كانت البيانات ناقصة أو متأثرة بالتحيزات والأخطاء، لن يؤدي نموذج الذكاء الاصطناعي حسب التوقعات.

لتحقيق الدقة، من الأفضل جمع البيانات من مجموعة متنوعة من المصادر العامة التي أثبتت موثوقيتها. استخدام مصدر أو مصدرين فقط يؤدي إلى مشاكل مثل النقص. كما يجب أن تضع المنظمات في اعتبارها التحقق التلقائي من صحة البيانات وتنظيفها، لتحقيق كفاءة في إزالة البيانات الخاطئة والمتضاربة.

في Bright Data، نأخذ جميع هذه العوامل في الاعتبار. نقدم لفرق الذكاء الاصطناعي بيانات حقيقية ومدقة تم التحقق من صحتها، بحيث يمكنهم تدريب النماذج بثقة.

ما هي أكبر المخاوف الأخلاقية في جمع البيانات العامة على الويب اليوم؟

الخصوصية لا تزال واحدة من أكبر المخاوف في جمع البيانات العامة على الويب. الناس قلقون من أن يتم الكشف عن بياناتهم وتعرضها للإساءة. من أجل ضمان أن تظل البيانات خاصة، من المهم التأكيد على الشفافية. يجب على المنظمات التي تجمع البيانات أن تكون واضحة بشأن البيانات التي تجمعها.

هناك قلق كبير آخر هو الاحتكار. الشركات الكبيرة تسيطر على كمية هائلة من البيانات، مما يخلق سوقًا غير متكافئ حيث يمكن فقط لبعض الشركات الوصول إلى المعلومات اللازمة لتدريب نماذج الذكاء الاصطناعي ودفع الابتكار. هذا ليس كما ينبغي أن يكون. يجب أن تظل البيانات العامة على الويب متاحة للشركات والباحثين والمطورين.

الأخلاقيات ليست بعد الفكر في Bright Data، بل هي متأصلة في كل quyếtتنا. نحن لا نتبع فقط المعايير الصناعية، بل نحددها. نحن نقود في صناعة جمع البيانات في تحديد المعايير الأخلاقية الصحيحة. نحن نريد أن نضمن أن يتم الوصول إلى البيانات العامة على الويب بشكل مسؤول وشفاف ومتوافق مع اللوائح العالمية.

كيف تضمن Bright Data الامتثال للوائح العالمية لخصوصية البيانات مع تمكين جمع البيانات على نطاق واسع؟

منظمةنا ملتزمة بالامتثال للمتطلبات القانونية والتنظيمية العالمية لجمع البيانات واستخدامها. نحن نضمن الامتثال لمتطلبات اللائحة العامة لحماية البيانات و CPRA و CCPA وغيرها من اللوائح ذات الصلة. كما نتبع بصرامة بروتوكول Know Your Customer (KYC) لضمان أن فقط المستخدمين المشروعة يمكنهم الوصول إلى منصتنا.

سياستنا المقبولة للاستخدام واضحة في تحديد ما يمكن جمعها وما لا يمكن جمعها من البيانات. هذا يشمل الاستخدام المسؤول. لدينا فريق امتثال مخصص لمراقبة اللوائح باستمرار لضمان أننا على دراية بأحدث المتطلبات القانونية والتنظيمية.

على الرغم من ذلك، نحن لا تزال نعتقد أن البيانات العامة على الويب يجب أن تظل متاحة. هدفنا هو تزويد فرق الذكاء الاصطناعي بالبيانات التي تحتاجها مع ضمان الامتثال للمعايير القانونية والخصوصية.

كيف توازن بين نمو الأعمال والحفاظ على ممارسات جمع البيانات الأخلاقية؟

نعتبر دائمًا الأخلاقيات والنمو غير قابلين للفصل. ثقة عملائنا والعلاقة التي نبنيها معهم هي أمور بالغ الأهمية. نحن نفهم أننا يمكن فقط تحقيق النجاح على المدى الطويل إذا جمعت البيانات بظروف شفافة وامتثالاً للقوانين السارية.

لذلك، قمنا بوضع بروتوكول فحص صارم للمستخدمين. هذا يهدف إلى ضمان أن يتم استخدام البيانات التي نجمعها بشكل أخلاقي. نقدم الوقت والجهد والموارد لضمان الامتثال والأمان لحماية عملائنا والجمهور بشكل عام. من خلال اتباع ممارسات جمع البيانات الأخلاقية، نحقق النجاح من الناحية التجارية ونساهم في إنشاء نظام ذكاء اصطناعي شفاف ومسؤول.

كيف تظل Bright Data في طليعة التغييرات التنظيمية في خصوصية البيانات؟

نفهم أن عملياتنا وسياساتنا لاستخدام البيانات يجب أن تتغير لتعكس التغييرات في القوانين واللوائح ذات الصلة. لذلك، نستشير الخبراء القانونيين ونتواصل مع الهيئات التنظيمية. كما ننخرط في مناقشات مع المشرعين وأصحاب المصلحة الآخرين في بناء السياسات، مما يساهم في صياغة لوائح بيانات ذات معنى.

إطارنا لجمع البيانات واستخدامها يتطور مع إصدار قوانين جديدة وتنقيح اللوائح. لدينا فريق امتثال يحدث سياسات استخدام البيانات بشكل استباقي لضمان أن منصتنا دائمًا متوافقة بالكامل.

ما هي الاتجاهات الناشئة في جمع البيانات للذكاء الاصطناعي التي يجب على الشركات أن تكون على دراية بها؟

جمع البيانات في الوقت الفعلي يصبح ضروريًا لنمذجة الذكاء الاصطناعي الحديثة. من المهم أن تتمكن من الوصول إلى أحدث البيانات أو البيانات الأحدث لتوفير مستوى عالٍ من الدقة وتقديم تجارب مستخدم أفضل.

اتجاه آخر ملحوظ هو الاعتماد على البيانات الاصطناعية المستخدمة في تعزيز البيانات، حيث يولد الذكاء الاصطناعي بيانات تكمّل مجموعات البيانات المجمعة من السيناريوهات الواقعية.

أنا أيضًا أرى اهتمامًا قويًا بالسعي إلى الذكاء الاصطناعي القابل للشرح. معظم نماذج الذكاء الاصطناعي الحالية تعاني من تأثير “الصندوق الأسود” أو نقص الشفافية في عمليات اتخاذ القرارات. الشركات تسعى إلى تغيير هذا النموذج من خلال إنشاء نماذج ذكاء اصطناعي يمكن أن توضح كيف وصلت إلى النتائج أو القرارات التي اتخذتها.

أخيرًا، الشركات على دراية بالزيادة في مخاوف خصوصية البيانات. لذلك، تقنيات الذكاء الاصطناعي التي تهدف إلى الحفاظ على خصوصية البيانات، مثل التعلم الفيدرالي، تصبح مطلوبة. المنظمات تريد تحقيق أقصى استفادة من تدريب نموذج الذكاء الاصطناعي دون المساس بخصوصية البيانات.

نحن نضمن أننا على دراية بهذه الاتجاهات، بحيث يمكننا بناء حلول تمكن فرق الذكاء الاصطناعي من الحفاظ على الميزة التنافسية.

كيف ترى وكلاء الذكاء الاصطناعي والآليين يغيرون مشهد جمع البيانات؟

في الوقت الحالي، تستخدم نماذج الذكاء الاصطناعي مجموعات بيانات منظمة يتم جمعها بشكل يدوي. هذه المجموعات تتم معالجتها أيضًا من خلال عمليات مثل المعالجة المسبقة وتنظيف البيانات، والتي غالبًا ما تتضمن تدخل بشري. هذا من المقرر أن يتغير قريبًا مع ظهور وكلاء الذكاء الاصطناعي لجمع البيانات وتحليلها بشكل مستقل لتدريب الذكاء الاصطناعي.

لقد أنشأنا بنية تحتية تدعم نشر وتطوير وكلاء الذكاء الاصطناعي، مما يسمح بالوصول السلس إلى البيانات عالية الجودة في الوقت الفعلي على الويب. هذه التكنولوجيا تسمح بنظم ذكاء اصطناعي متقدمة بالتفاعل المستمر مع البيانات الديناميكية على الويب، والتعلم منها، وتطويرها.

يمكن لوكلاء الذكاء الاصطناعي تحويل الصناعات من خلال تمكين الأنظمة الذكية من الوصول إلى مجموعات بيانات متغيرة على الويب بدلاً من الاعتماد على بيانات مجمعة ومدروسة يدوياً. هذا يمكن أن يؤدي إلى تحسينات كبيرة في الكفاءة وفتح مجالات جديدة للآلية.

في Bright Data، لسنا فقط نسهل هذا التحول في مشهد جمع البيانات، بل نعتقد أننا في طليعة تقديم تكنولوجيا تفتح الباب لجيل جديد من الذكاء الاصطناعي. نحن متحمسون لمساعدة الشركات وفرق الذكاء الاصطناعي على استغلال إمكانات وكلاء الذكاء الاصطناعي بشكل كامل.

شكرًا على المقابلة الرائعة، القراء الذين يرغبون في معرفة المزيد يمكنهم زيارة Bright Data.

أنطوان هو قائد رؤيوي وشريك مؤسس في Unite.AI، مدفوعًا برغبة لا تكل في تشكيل وتعزيز مستقبل الذكاء الاصطناعي والروبوتات. وهو رائد أعمال متسلسل، يعتقد أن الذكاء الاصطناعي سيكون مدمرًا للمجتمع مثل الكهرباء، وغالبًا ما يُقبض عليه وهو يثرثر عن إمكانات التكنولوجيا المثيرة للدهشة والذكاء الاصطناعي العام.

كما أنه مستقبلي، فهو مخصص لاستكشاف كيف ستشكل هذه الابتكارات العالم. بالإضافة إلى ذلك، فهو مؤسس Securities.io، وهي منصة تركز على الاستثمار في التكنولوجيا المتقدمة التي تعيد تعريف المستقبل وتعيد تشكيل القطاعات بأكملها.