قادة الفكر

من يملك حق تدقيق الذكاء الاصطناعي المتقدم؟ التعريف المفقود في اتفاقية البيت الأبيض

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

هذا الأسبوع، وقع قادة Google وOpenAI وAnthropic وMeta وxAI وNvidia على اتفاقية البيت الأبيض للذكاء الفائق. التزمت الشركات بـ أربعة طبقات من الرقابة على النماذج المتقدمة: ضوابط داخلية، وفريق داخلي يتحقق منها، ومُدقّق أو مقيم خارجي مستقل، ولجنة مجلس إدارة مستقلة. الالتزامات طوعية في الوقت الحالي، وتفيد الاتفاقية بأنها قد تُكتب في القانون مستقبلاً.

من بين الأربعة طبقات، يحمل التقييم الخارجي الوزن الأكبر. إنها الطبقة الوحيدة التي تضع شخصًا خارج الشركة في موقع يمكنه من القول ما إذا كانت الضوابط تعمل. كما أنها الأقل تعريفًا. لا تحدد الاتفاقية من هو المؤهل كـمُقَيِّم مستقل، ولا ما هو المعيار الذي يُقَيِّم ضده، ولا مقدار الوصول الذي يحصل عليه، ولا كيف تُحافظ الاستقلالية عندما يبيع المُقَيِّم أيضًا خدمات للشركة التي يراجعها. كل شركة تختار مُقَيِّمها الخاص.

بموجب تلك الشروط، يمكن لشركتين أن تعلنا أنهما اجتازتا تقييمًا مستقلًا وتقصدان أشياء مختلفة تمامًا. سيتطلب سد تلك الفجوة الحصول على إجابات لثلاثة أسئلة.

ما الذي يجب أن يحدد من هو المؤهل

يحتاج تعريف موثوق لمُقَيِّم الذكاء الاصطناعي المستقل إلى تغطية ما لا يقل عن أربعة أمور.

الاستقلالية. لا ينبغي للمُقَيِّم مراجعة الضوابط التي ساهم في تصميمها، ولا ينبغي له بيع خدمات الإصلاح أو الاستشارات لنفس الشركة التي يقيمها. تُراقب مجالات التدقيق الناضجة أيضًا اعتماد الرسوم. عندما يشكل عميل واحد حصة كبيرة من إيرادات المُقَيِّم، يكون لدى المُقَيِّم سبب لتخفيف المتطلبات.

الكفاءة المتوافقة مع الوظيفة. “التدقيق” يشمل عدة أنشطة مختلفة في مجال الذكاء الاصطناعي. اختبار نموذج لتحديد قدراته الخطرة، مثل المساعدة في هجوم إلكتروني أو سلاح بيولوجي، يتطلب باحثي تعلم الآلة وخبراء المجال. التحقق مما إذا كانت ضوابط الشركة مصممة بشكل جيد وتعمل فعليًا يتطلب مدقّقين متمرسين في الضوابط. المُقَيِّم المؤهل لأحدهما لا يكون مؤهلاً تلقائيًا للآخر، ويجب أن يذكر تقرير التقييم أي منهما تم إجراؤه.

الوصول والنطاق. المُقَيِّم الذي يطلع فقط على الوثائق يمكنه تأكيد وجود ضابط على الورق. تأكيد أنه يعمل يتطلب الوصول إلى الأنظمة والسجلات وسجلات الموافقات والأشخاص على مدار فترة زمنية. تتغير النماذج المتقدمة بين عمليات التدريب والنشر، لذا يحتاج المُقَيِّم أيضًا إلى قاعدة واضحة لتحديد متى يتطلب التغيير مراجعة جديدة.

الإشراف على المُقَيِّم. يجب أن يكون هناك من يتحقق من المدققين. في أسواق التدقيق القائمة، تقوم هيئات الاعتماد بمراجعة عمل المُقَيِّمين ويمكنها سحب مكانتهم عندما تكون غير كافية. ذلك الضمان هو ما يمنح استنتاجات التقييم وزنًا.

البنية التحتية الموجودة بالفعل

  لا يلزم اختراع أي من ذلك من الصفر. ISO 42001، المعيار الدولي لأنظمة إدارة الذكاء الاصطناعي، يوفر للمنظمات إطارًا لحوكمة الذكاء الاصطناعي، مع ضوابط موثقة، مالكين واضحين وتحسين مستمر. المعيار المرافق له، ISO 42006، يحدد المتطلبات للهيئات التي تدقق وتصدّر شهادات وفقًا لـ ISO 42001، بما في ذلك الكفاءة التي يجب أن يظهرها المدققون والقواعد المتعلقة بالحياد التي يجب عليهم الالتزام بها. وبما أن هيئات الاعتماد تعمل تحت نظام الاعتماد، فإن طرفًا ثالثًا يشرف على المدققين أنفسهم.

في جانب الاختبار التقني، تُملأ الفجوات بأطر عمل أحدث. AIUC-1 يصدّق على وكلاء الذكاء الاصطناعي المحددين في عمليات نشر محددة، مع اختبارات دورية من طرف ثالث للمشكلات مثل الهلاوس، واختراقات الأنظمة، واستخدام الأدوات غير الآمن، ويستند إلى ضوابط ISO 42001.

تقوم الولايات أيضًا باختبار النماذج للإشراف مباشرة على المُقَيِّمين. مرتّ ولاية كونيتيكت قانونًا هذا العام ينشئ برنامجًا تجريبيًا، يبدأ في يوليو 2027، حيث سيُعتمد من قبل إدارة حماية المستهلك بالولاية ما يصل إلى خمس منظمات تحقق مستقلة. يجب على كل منها الدخول في اتفاقية تحت إشراف الدولة تحدد نطاقها وطرقها والتزاماتها في التقارير والحوكمة. يجيب هذا الهيكل على عدة من أسئلة الاتفاقية المفتوحة: من يوافق على المُقَيِّمين، وما المعايير التي يُحكم عليهم بها، ومن يشرف عليهم.

لم تُصمم هذه العناصر لتقييم النماذج المتقدمة، ولا ينبغي تقديمها كإجابة شاملة. العمل القادم هو ربطها، بحيث يتكامل ضمان نظام الإدارة، واختبار النموذج التقني، وإشراف المُقَيِّم تحت تعريف موثوق للاستقلالية.

لماذا يجب أن تُوضع القواعد أولًا

الالتزامات في الاتفاقية طوعية حاليًا. إذا تحولت إلى قانون، يجب أن تكون القواعد التي تحدد من يمكنه أن يكون مُقَيِّمًا موجودة قبل سريان التفويض، وذلك لثلاثة أسباب.

أولاً، تصبح الممارسات المبكرة سابقة. بمجرد أن يبدأ الموقعون في تسمية المُقَيِّمين ونشر النتائج، سيستقر السوق على تعريفات عملية لمصطلحي “المستقل” و”المؤهل”. تميل التعريفات التي تُضع دون ضغط خارجي إلى تفضيل الراحة. سيجد صانعو القوانين الذين يأتون لاحقًا تلك التعريفات مدمجة بالفعل في العقود والتوقعات.

ثانيًا، بناء القدرة المؤهلة يستغرق وقتًا. اعتماد هيئات التقييم، وتدريب المقيمين الذين يفهمون كلًا من نماذج الحدود المتقدمة واختبار الضوابط، وتطوير أساليب مشتركة كلها تستغرق سنوات. سيُلبّى أي تفويض يُصدر قبل وجود تلك القدرة من قبل من هو متاح.

ثالثًا، المتطلب دون وجود سوق لمقيمي مؤهلين خلفه يؤدي إلى مجرد إكمال الصناديق. ستُرضي الشركات نص القاعدة، وسيكون للمنظمين أساس ضئيل لتحدي التقييمات الضعيفة، وسيحصل الجمهور على مظهر الرقابة دون الكثير من الجوهر.

يجادل البعض بأن الوقت لا يزال مبكرًا لوضع هذه القواعد لأن علم تقييم نماذج الحدود لا يزال حديثًا. هذا قلق مشروع بشأن أساليب الاختبار، التي يجب أن تستمر في التطور مع تطور النماذج. الأسئلة المطروحة هنا تتعلق بالمقيم: ما إذا كان خالًٍا من تضارب المصالح، ومؤهلاً للوظيفة، وممنوحًا للوصول الكافي وخاضعًا للرقابة. تلك الأسئلة لها إجابات ثابتة، ومجالات الضمان الأخرى تجيب عليها منذ عقود.

ما يمكن للمنظمات القيام به الآن

لا تحتاج الشركات التي تبني أو تنشر الذكاء الاصطناعي المتقدم إلى الانتظار للحصول على تفويض. عند اختيار مقيم، يمكنها أن تسأل عن الخدمات الأخرى التي تقدمها الشركة لها، وما هي مؤهلات فريقها للنوع المحدد من التقييم، ومدى الوصول الذي تشملها المشاركة، ومن يشرف على عمل الشركة. بناء نظام إدارة للذكاء الاصطناعي الآن يمنح أي مقيم مستقبلي شيئًا ملموسًا وموثقًا لتقييمه.

يضع الاتفاق إطارًا سليمًا للمساءلة في مجال الذكاء الاصطناعي. ستعتمد قيمته على من يشغل دور المقيم وما يُطلب منه، والوقت اللازم لتحديد ذلك يكون قبل أن يُطلب من أي جهة استخدامه.

باتريك سوليفان هو نائب الرئيس لل استراتيجية والابتكار في A-LIGN، حيث يتخصص في حوكمة الذكاء الاصطناعي وأمن المعلومات والامتثال. مع أكثر من 25 عامًا من الخبرة في الصناعة، يركز باتريك على تقديم التوجيه والإرشاد والدعم لعملائنا وشركائنا، لمساعدتهم على التنقل في المناظر المتطورة والمعقدة لحوكمة الذكاء الاصطناعي وأمن المعلومات والامتثال. خبرته تعتبر أداة أساسية في مساعدة المنظمات على تحقيق أهداف الأمن والامتثال الاستراتيجية بشكل فعال.