نماذج ومنصات الذكاء الاصطناعي
بيتر ستار، عالم آي بي إم، ومجموعة بيانات البحث المفتوحة لفيروس كورونا – سلسلة المقابلات

قام عالم آي بي إم بيتر ستار بتطوير أداة ذكاء اصطناعي يتم استخدامها من قبل أكثر من 300 خبير يعملون على تطوير علاج أو لقاح لفيروس كورونا.
为了帮助 الباحثين الوصول إلى البيانات المنظمة وغير المنظمة بسرعة، تقدم آي بي إم موردًا بحثيًا قائمًا على السحابة مدربًا على مجموعة من أكثر من 45,000 ورقة علمية تحتويها مجموعة بيانات البحث المفتوحة لفيروس كورونا (CORD-19)، التي أعدوها البيت الأبيض وائتلاف من مجموعات البحث، وقواعد بيانات مرخصة من DrugBank و Clinicaltrials.gov و GenBank.
انضم الدكتور بيتر ستار إلى مختبر آي بي إم للأبحاث – زيورخ في يوليو 2015 كزميل بحثي بعد الدكتوراه في مشروع أسس حلول إدراكية.
انضممت لأول مرة إلى مختبر آي بي إم للأبحاث – زيورخ في يوليو 2015. ما هي أنواع المشاريع التي عملت عليها في آي بي إم؟
ركز بحثي الأول على التطبيقات لحوسبة الأداء العالي وكان جزءًا من الفريق الفائز بجائزة غوردون بيل التذكارية للجمعية الأمريكية للحوسبة.
في عام 2017، بدأت في التركيز على الذكاء الاصطناعي، ونشر فريقي ورقة في مؤتمر ACM على اكتشاف المعرفة والتعدين في البيانات (KDD 2018) حول نظام استهلاك الوثائق القابل للتوسيع بشكل هائل، والذي أسميناه خدمة تحويل المجموعة.
متى أدركت آي بي إم لأول مرة فكرة استخدام خدمة تحويل المجموعة لمواجهة وباء كورونا؟
في منتصف مارس، قاد البيت الأبيض جهودًا لنشر أكثر من 45,000 وثيقة حول فيروس كورونا ومرض كورونا.
كيف يمكنك وصف أفضل ما هو خدمة تحويل المجموعة؟
كما هو الحال مع أي حجم كبير من مصادر البيانات المتنوعة، من الصعب تحليل هذه البيانات بفعالية ودمجها بطرق يمكن أن تؤدي إلى رؤى علمية.
يمكنك مناقشة التحدي الرئيسي لاستخراج البيانات من تنسيق PDF إلى شكل قابل للبحث؟
وفقًا لأدوبي، هناك حوالي 2.5 تريليون ملف PDF حاليًا في التداول.
غالبًا ما تحتوي ملفات PDF على مجموعات من الرسومات المتجهة والنص والرسومات النقطية، والتي تجعل استخراج البيانات الكمية والنوعية khá تحديًا.
كيف تستخرج ليس فقط النص الموجود في الوثيقة ولكن أيضًا هيكلها؟
عنصر رئيسي هو أننا صممنا التفاعل بين الإنسان والحاسوب في النظام للسماح بالتعليق السريع والهائل بدون أي معرفة بالعلوم الحاسوبية.
يمكنك مناقشة تحديات بناء نموذج تعلم الآلة الذي يمكن أن يتوسع ويتجاوب بسرعة مع مئات المستخدمين، بل وألف المستخدمين المحتملين؟
لقد قمنا بتطوير خدمة تحويل المجموعة على خدمات السحابة الحديثة، مثل OpenShift على سحابة آي بي إم.
كم عدد الوثائق التي تم استهلاكها في الخدمة؟
لدينا عدة عملاء صناعيين يستخدمون الأدوات، لذلك لا نعرف كم عدد الوثائق التي استهلكوها لأن كل واحد منهم يمتلك مثيله الخاص من مثيلات سحابة آي بي إم.
كيف رد مجتمع البحث على استخدام أداة الذكاء الاصطناعي هذه؟
منذ أن أعلنا عن توفر الأداة مجانًا قبل بضعة أسابيع، لدينا أكثر من 400 مستخدم من أكثر من عشر دول، معظمهم من الأطباء والأساتذة.
هل هناك أي شيء آخر تود مشاركته حول خدمة تحويل المجموعة و/أو كيفية استخدامها في سياق فيروس كورونا؟
أحد عملائنا هو شركة الطاقة الإيطالية إيني، التي تستخدم تكنولوجيانا لاستكشاف الهيدروكربونات، وهو عمل معقد ومتطلب للمعرفة ي涉ل العديد من التخصصات الهندسية والعلمية التي تعمل معًا.
في إيني، يعتمد المعرفة على معالجة كميات كبيرة من البيانات الجيولوجية والفيزيائية والكيميائية الجيوكيميائية، والتي يتم بعد ذلك تحويلها إلى مخطط معرفي.
يمكن للعلماء الجيولوجيين استخدام الذكاء الاصطناعي لتقديم المعلومات ذات الصلة في سياقها، مما يساعدهم على تحسين اتخاذ القرارات وتحديد سيناريوهات استكشاف بديلة.
شكرًا على هذه المقابلة المهمة جدًا، هذا سوف يوفر للمحققين ساعات لا حصر لها.












