نماذج ومنصات الذكاء الاصطناعي

لماذا يتجاهل النماذج اللغة الكبيرة الإرشادات وكيفية معالجة هذه القضية

mm
أضف Unite.AI إلى مصادرك المفضلة على Google
LLM instruction skipping fix

نماذج اللغة الكبيرة (LLM) أصبحت أدوات ذكاء اصطناعي لا غنى عنها، وتقوم بالتطبيقات من محادثات البوتات وإنشاء المحتوى إلى مساعدة البرمجة. على الرغم من قدراتها المذهلة، فإن تحديًا شائعًا يواجهه المستخدمون هو أن هذه النماذج تتجاهل أحيانًا أجزاء من الإرشادات التي تتلقاها، خاصة عندما تكون الإرشادات طويلة أو تتضمن عدة خطوات. هذا التجاهل يؤدي إلى مخرجات غير كاملة أو غير دقيقة، مما يمكن أن يسبب ارتباكًا ويتآكل الثقة في أنظمة الذكاء الاصطناعي. فهم لماذا تتجاهل نماذج اللغة الكبيرة الإرشادات وكيفية معالجة هذه القضية أمر ضروري للمستخدمين الذين يعتمدون على هذه النماذج للحصول على نتائج دقيقة وموثوقة.

لماذا تتجاهل نماذج اللغة الكبيرة الإرشادات؟

تعمل نماذج اللغة الكبيرة عن طريق قراءة النص الإدخالي كتسلسل من الرموز. الرموز هي الأجزاء الصغيرة التي يتم تقسيم النص إليها. يقوم النموذج بمعالجة هذه الرموز واحدة تلو الأخرى، من البداية إلى النهاية. هذا يعني أن الإرشادات في بداية الإدخال تميل إلى الحصول على المزيد من الاهتمام. الإرشادات اللاحقة قد تتلقى اهتمامًا أقل ويمكن تجاهلها.

يحدث هذا لأن نماذج اللغة الكبيرة لديها قدرة اهتمام محدودة. الاهتمام هو الآلية التي يستخدمها النموذج لتحديد أجزاء الإدخال الأساسية عند توليد الاستجابات. عندما يكون الإدخال قصيرًا، يعمل الاهتمام جيدًا. لكن الاهتمام يصبح أقل كلما زاد طول الإدخال أو تعقيد الإرشادات. هذا يضعف التركيز على الأجزاء اللاحقة، مما يؤدي إلى تجاهلها.

بالإضافة إلى ذلك، يمكن أن يزيد عدد الإرشادات في وقت واحد من التعقيد. عندما تتداخل الإرشادات أو تتعارض، قد يصبح النموذج محبوسًا. قد يحاول الإجابة على كل شيء ولكن ينتج استجابات غامضة أو متناقضة. هذا غالبًا ما يؤدي إلى فقدان بعض الإرشادات.

نماذج اللغة الكبيرة تشترك أيضًا في بعض القيود البشرية. على سبيل المثال، يمكن للبشر أن يفقدوا التركيز عند قراءة النصوص الطويلة أو المتكررة. بشكل مماثل، يمكن لنماذج اللغة الكبيرة أن “ينسى” الإرشادات اللاحقة أثناء معالجة المزيد من الرموز. هذا فقدان للتركيز هو جزء من تصميم النموذج وقيوده.

سبب آخر هو كيفية تدريب نماذج اللغة الكبيرة. يرى النموذج العديد من الأمثلة على الإرشادات البسيطة ولكن عددًا أقل من الإرشادات المعقدة متعددة الخطوات. بسبب ذلك، يميل النموذج إلى اتباع الإرشادات البسيطة التي هي أكثر شيوعًا في بيانات التدريب. هذا التحيز يجعله يتجاهل الإرشادات المعقدة. بالإضافة إلى ذلك، تقيد حدود الرموز كمية الإدخال التي يمكن للنموذج معالقتها. عندما يتجاوز الإدخال هذه الحدود، يتم تجاهل الإرشادات التي تتجاوز الحد.

مثال: افترض أنك تعطي نموذج اللغة الكبيرة خمس إرشادات في سؤال واحد. قد يركز النموذج بشكل رئيسي على الإرشادات الأولى والثانية ويتجاهل الإرشادات الثلاثة الأخيرة جزئيًا أو كليًا. هذا يؤثر مباشرة على كيفية معالجة النموذج للرموز بشكل متسلسل وقيود الاهتمام.

كيفية إدارة الإرشادات المتتالية في نماذج اللغة الكبيرة بناءً على نتائج SIFo 2024

أجريت دراسات最近 لتحليل كيفية اتباع نماذج اللغة الكبيرة للإرشادات المتتالية. واحدة من الدراسات المهمة هي اختبار متابعة الإرشادات المتتالية (SIFo) 2024. هذا الاختبار يختبر النماذج على مهام تحتاج إلى إكمال متسلسل للإرشادات مثل تعديل النص والاستجابة على الأسئلة والرياضيات ومتابعة القواعد الأمنية. كل إرشادة في التسلسل تعتمد على إكمال الإرشادة السابقة بشكل صحيح. هذا النهج يساعد على التحقق من是否 اتبع النموذج التسلسل بالكامل.

تظهر النتائج من SIFo أن حتى أفضل نماذج اللغة الكبيرة، مثل GPT-4 وClaude-3، غالبًا ما يجدون صعوبة في إكمال جميع الإرشادات بشكل صحيح. هذا尤خص عندما تكون الإرشادات طويلة أو معقدة. يشير البحث إلى ثلاث مشاكل رئيسية تواجه نماذج اللغة الكبيرة في اتباع الإرشادات:

الفهم: فهم كل إرشادة بشكل كامل.

الاستدلال: ربط الإرشادات المتعددة بشكل منطقي للاحتفاظ بالاستجابة واضحة.

الإخراج الموثوق: إنتاج استجابات كاملة ودقيقة، تغطي جميع الإرشادات المحددة.

تقنيات مثل هندسة الإرشادات وضبط دقيق تساعد على تحسين كيفية اتباع النماذج للإرشادات. ومع ذلك، هذه الأساليب لا تساعد بشكل كامل في مشكلة تجاهل الإرشادات. استخدام التعلم التعزيزي مع反馈 بشري (RLHF) يعزز من قدرة النموذج على الاستجابة بشكل مناسب. ومع ذلك، النماذج تواجه صعوبة عندما تتطلب الإرشادات العديد من الخطوات أو تكون معقدة للغاية.

كما يظهر الدراسة أن نماذج اللغة الكبيرة تعمل بشكل أفضل عندما تكون الإرشادات بسيطة ومنفصلة ومتظمة جيدًا. عندما تتطلب المهام سلاسل استدلال طويلة أو العديد من الخطوات، ينخفض دقة النموذج. هذه النتائج تساعد على اقتراح طرق أفضل لاستخدام نماذج اللغة الكبيرة بشكل جيد وتظهر الحاجة إلى بناء نماذج أقوى يمكنها اتباع الإرشادات بشكل متسلسل.

لماذا تتجاهل نماذج اللغة الكبيرة الإرشادات: التحديات الفنية والاعتبارات العملية

نماذج اللغة الكبيرة قد تتجاهل الإرشادات بسبب عدة عوامل فنية وعملية متجذرة في كيفية معالجة النص الإدخالي وتشفيره.

الانتباه المحدود وتخفيف المعلومات

تعتمد نماذج اللغة الكبيرة على آليات الانتباه لتخصيص أهمية لأجزاء الإدخال المختلفة. عندما تكون الإرشادات موجزة، يكون انتباه النموذج مركزًا وفعالًا. ومع ذلك، كلما زاد طول الإرشادات أو تكرارها، يصبح الانتباه أقل تركيزًا، ويتلقى الرموز أو الإرشادات اللاحقة انتباهًا أقل، مما يزيد من احتمالية تجاهلهم. هذا الظاهرة، المعروفة بتخفيف المعلومات، هي مشكلة خاصة بالإرشادات التي تظهر في نهاية الإرشادات. بالإضافة إلى ذلك، النماذج لديها حدود رموز ثابتة (مثل 2048 رمز)، ويتجاهل أي نص يتجاوز هذا الحد، مما يؤدي إلى تجاهل الإرشادات في النهاية بالكامل.

تعقيد الإخراج وغموضه

نماذج اللغة الكبيرة قد تواجه صعوبة في إخراج استجابات واضحة وكاملة عند مواجهة إرشادات متعددة أو متعارضة. قد ينتج النموذج استجابات جزئية أو غامضة لتجنب التناقضات أو الارتباك، مما يؤدي بشكل فعال إلى تجاهل بعض الإرشادات. الغموض في صياغة الإرشادات يطرح أيضًا تحديات: الإرشادات الغامضة أو غير الدقيقة تجعل من الصعب على النموذج تحديد الإجراءات المقصودة، مما يزيد من خطر تجاهل أو سوء تفسير أجزاء من الإدخال.

تصميم الإرشادات وحساسية التنسيق

هيكل وتنسيق الإرشادات يلعب دورًا حاسمًا في اتباع الإرشادات. يظهر البحث أن حتى التغييرات الصغيرة في كيفية كتابة أو تنسيق الإرشادات يمكن أن تؤثر بشكل كبير على是否 يتبع النموذج الإرشادات.

الإرشادات السيئة الهيكل، التي تفتقر إلى الفصل الواضح أو النقاط أو الأرقام، تجعل من الصعب على النموذج التمييز بين الخطوات، مما يزيد من فرصة دمج أو تجاهل الإرشادات. تمثيل النموذج الداخلي للإرشادات حساس للغاية لهذه التغييرات، مما يفسر لماذا يمكن أن ي cải thiện هندسة الإرشادات (إعادة صياغة أو إعادة هيكلة الإرشادات) بشكل كبير اتباع الإرشادات، حتى إذا بقي المحتوى الأساسي على حاله.

كيفية إصلاح تجاهل الإرشادات في نماذج اللغة الكبيرة

تحسين قدرة نماذج اللغة الكبيرة على اتباع الإرشادات بدقة أمر ضروري لإنتاج نتائج موثوقة ودقيقة. يجب مراعاة أفضل الممارسات التالية لتقليل تجاهل الإرشادات وتحسين جودة الاستجابات التي تولدها الذكاء الاصطناعي:

ينبغي تقسيم المهام إلى أجزاء أصغر

المدخلات الطويلة أو متعددة الخطوات ينبغي تقسيمها إلى مقاطع أكثر تركيزًا. تقديم إرشادة أو إرشادتين في المرة الواحدة يسمح للنموذج بالحفاظ على انتباه أفضل ويقلل من احتمالية تفويت أي خطوات.

مثال

بدلاً من دمج جميع الإرشادات في سؤال واحد، مثل “قم بملخص النص، قائمة النقاط الرئيسية، اقترح تحسينات، وترجمها إلى الفرنسية،” ينبغي تقديم كل إرشادة بشكل منفصل أو في مجموعات صغيرة.

ينبغي تنسيق الإرشادات باستخدام قوائم مرقمة أو نقاط

تنظيم الإرشادات باستخدام تنسيق صريح، مثل القوائم المرقمة أو النقاط، يساعد على إظهار أن كل عنصر هو مهمة فردية. هذه الوضوح تزيد من فرصة أن تكون الاستجابة موجهة إلى جميع الإرشادات.

مثال

  • قم بملخص النص التالي.
  • قائمة النقاط الرئيسية.
  • اقترح تحسينات.

这样的 تنسيق يوفر إشارات بصرية تساعد النموذج على التعرف على المهام الفردية داخل الإرشادات.

ينبغي أن تكون الإرشادات صريحة وواضحة

من المهم أن تكون الإرشادات واضحة في تحديد المتطلبات لإكمال كل خطوة. ينبغي تجنب اللغة الغامضة أو غير الواضحة. الإرشادة يجب أن تشير صراحة إلى أن لا خطوة يمكن تجاهلها.

مثال

“يرجى إكمال جميع المهام الثلاث التالية. لا يمكن تجاهل أي خطوة.”

بيانات مباشرة مثل هذه تقلل من الارتباك وتشجع النموذج على تقديم استجابات كاملة.

ينبغي استخدام إرشادات منفصلة لل مهام الحساسة أو الحرجة

ينبغي تقديم كل إرشادة كإرشادة فردية للمهام التي تتطلب دقة واكتمال. على الرغم من أن هذا النهج قد يزيد من وقت التفاعل، إلا أنه يحسن بشكل كبير من احتمالية الحصول على مخرجات كاملة ودقيقة. هذا الأسلوب يضمن أن يركز النموذج بشكل كامل على مهمة واحدة في كل مرة، مما يقلل من خطر تجاهل الإرشادات.

استراتيجيات متقدمة لتحقيق التوازن بين الإكمال والكفاءة

الانتظار لاستجابة بعد كل إرشادة فردية يمكن أن يكون وقتياً للمستخدمين. لتحسين الكفاءة مع الحفاظ على الوضوح وتقليل الإرشادات المتجاهلة، يمكن أن تكون تقنيات الإرشادات المتقدمة فعالة:

تجميع الإرشادات مع تنسيق واضح وتسميات صريحة

يمكن دمج عدة إرشادات متعلقة في سؤال واحد، ولكن كل إرشادة يجب فصلها باستخدام الأرقام أو العناوين. الإرشادة يجب أن تُحذر النموذج من الاستجابة لجميع الإرشادات بشكل كامل وبالترتيب.

مثال الإرشادة

يرجى إكمال جميع المهام التالية بعناية دون تجاهل أي منها:

  1. قم بملخص النص أدناه.
  2. قائمة النقاط الرئيسية من ملخصك.
  3. اقترح تحسينات بناءً على النقاط الرئيسية.
  4. ترجمة النص المحسن إلى الفرنسية.

إرشادات أسلوب السلسلة الفكرية

إرشادات أسلوب السلسلة الفكرية توجيه النموذج إلى التفكير في كل مهمة خطوة بخطوة قبل تقديم إجابة. تشجيع النموذج على معالجة الإرشادات بشكل متسلسل داخل استجابة واحدة يساعد على ضمان عدم تجاهل أي خطوات، مما يقلل من خطر تجاهل الإرشادات وتحسين الإكمال.

مثال الإرشادة

اقرأ النص أدناه وقم بالمهام التالية بالترتيب. أظهر عملك بوضوح:

  • قم بملخص النص.
  • حدد النقاط الرئيسية من ملخصك.
  • اقترح تحسينات للنص.
  • ترجمة النص المحسن إلى الفرنسية.

يرجى الإجابة على جميع المهام بشكل كامل ومنفصل في رد واحد.

إضافة إرشادات الإكمال والتذكير

التنبيه الصريح للنموذج إلى:

  • “الإجابة على كل مهمة بشكل كامل.”
  • “لا تتجاهل أي إرشادة.”
  • “افصل إجاباتك بوضوح.”

تذكيرات مثل هذه تساعد النموذج على التركيز على الإكمال عند دمج عدة إرشادات.

ينبغي اختبار نماذج وضبطات مختلفة

ليس جميع نماذج اللغة الكبيرة تعمل بنفس الكفاءة في اتباع الإرشادات المتعددة. من المستحسن تقييم نماذج مختلفة لتحديد تلك التي تتفوق في المهام المتعددة. بالإضافة إلى ذلك، تعديل المعلمات مثل الحرارة، الحد الأقصى للرموز، والإرشادات النظامية قد ي cải thiện من تركيز النموذج واكتمال الاستجابات. اختبار هذه الإعدادات يساعد على تخصيص سلوك النموذج لمتطلبات المهمة المحددة.

ضبط دقيق النماذج واستخدام أدوات خارجية يجب مراعاته

ينبغي ضبط النماذج بدقة على مجموعات بيانات تحتوي على إرشادات متعددة أو متتالية لتحسين اتباعها للإرشادات المعقدة. تقنيات مثل RLHF يمكن أن تعزز من اتباع الإرشادات.

للحالات المتقدمة، يمكن دمج أدوات خارجية مثل واجهات برمجة التطبيقات أو إضافات محددة للمهمة أو نظام التوليد المعزز بالاسترجاع (RAG) لتوفير سياقًا إضافيًا ومراقبة، مما يحسن من موثوقية ودقة المخرجات.

الخلاصة

نماذج اللغة الكبيرة أدوات قوية، لكنها قد تتجاهل الإرشادات عند طولها أو تعقيدها. هذا يحدث بسبب كيفية قراءة الإدخال وتركيز الانتباه. الإرشادات يجب أن تكون واضحة وبسيطة ومنظمة جيدًا لتحقيق نتائج أفضل وأكثر موثوقية. تقسيم المهام إلى أجزاء صغيرة، استخدام القوائم، وتقديم إرشادات مباشرة تساعد النماذج على اتباع الخطوات بشكل كامل.

الإرشادات المنفصلة يمكن أن تحسن الدقة للمهام الحرجة، على الرغم من أنها تتطلب وقتًا أطول. بالإضافة إلى ذلك، أساليب الإرشادات المتقدمة مثل أسلوب السلسلة الفكرية والتنسيق الواضح تساعد على تحقيق توازن بين السرعة والدقة. علاوة على ذلك، اختبار نماذج مختلفة وضبطها يمكن أن يحسن النتائج. هذه الأفكار ستساعد المستخدمين على الحصول على استجابات متسقة وكاملة، مما يجعل أدوات الذكاء الاصطناعي أكثر فائدة في العمل الحقيقي.

الدكتور أسعد عباس، أستاذ مساعد متفرغ في جامعة كومساطس إسلام آباد، باكستان، حصل على دكتوراه من جامعة نورث داكوتا الحكومية، الولايات المتحدة الأمريكية. يركز بحثه على التكنولوجيا المتقدمة، بما في ذلك الحوسبة السحابية، وحوسبة الضباب، وحوسبة الحافة، وتحليل البيانات الكبيرة، والذكاء الاصطناعي. قدم الدكتور عباس مساهمات كبيرة من خلال المنشورات في المجلات العلمية والمؤتمرات ذات السمعة الطيبة. وهو أيضًا مؤسس MyFastingBuddy.