الذكاء الاصطناعي العام وذكاء المستقبل
استكشاف جيميني 1.5: كيف يرفع أحدث نموذج الذكاء الاصطناعي المتعدد الوضع من جوجل الساحة الاصطناعية إلى ما هو أبعد من سابقه
في المناظر الطبيعية المتغيرة بسرعة للذكاء الاصطناعي، تواصل جوجل قيادة التطورات الرائدة في تقنيات الذكاء الاصطناعي المتعدد الوضع. بعد ظهور جيميني 1.0، نموذج اللغة الكبير المتعدد الوضع الحدودي، أعلنت جوجل الآن عن جيميني 1.5. هذه النسخة لا تحسن فقط القدرات التي أنشأتها جيميني 1.0 ولكن أيضًا تقدم تحسينات كبيرة في منهجية جوجل لمعالجة وتكامل البيانات المتعددة الوضع. يتيح هذا المقال استكشافًا لجيميني 1.5، مما يلقي الضوء على نهجه المبتكر وميزاته الفريدة.
جيميني 1.0: وضع الأساس
أطلق جيميني 1.0 من قبل جوجل ديبمايند وجوجل ريسيرش في 6 ديسمبر 2023، وتمثل نموذجًا جديدًا من نماذج الذكاء الاصطناعي المتعدد الوضع القادرة على فهم وتوليد المحتوى في تنسيقات مختلفة، مثل النص والصوت والصور والفيديو. يمثل هذا خطوة كبيرة في الذكاء الاصطناعي، حيث يوسع نطاق إدارة أنواع المعلومات المتنوعة.
الميزة البارزة لجيميني هي قدرته على مزج أنواع البيانات المتعددة بسهولة. على عكس نماذج الذكاء الاصطناعي التقليدية التي قد تتخصص في تنسيق بيانات واحد، يدمج جيميني النص والمرئيات والصوت. يتيح هذا النموذج أداء مهام مثل تحليل الملاحظات المكتوبة يدويا أو فك شفرة الرسومات المعقدة، وبالتالي حل مجموعة واسعة من التحديات المعقدة.
توفر عائلة جيميني نماذجًا لمختلف التطبيقات: نموذج أولترا للمهام المعقدة، نموذج برو لسرعة التوسع على منصات رئيسية مثل جوجل بارد، ونموذج نانو (نانو-1 ونانو-2) مع 1.8 مليار و3.25 مليار معامل، على التوالي، مصممين للتكامل في أجهزة مثل هاتف جوجل بيكسل 8 برو.
القفزة إلى جيميني 1.5
يحسن إصدار جوجل الأخير، جيميني 1.5، من الوظائف والكفاءة التشغيلية لسابقه، جيميني 1.0. يعتمد هذا الإصدار على هيكل جديد من نوع “مزيج الخبراء” (MoE)، وهو انحراف عن نهج النموذج الكبير الموحد الموجود في سابقه. يدمج هذا الهيكل مجموعة من نماذج التランスفورمر الصغيرة المتخصصة، كل منها ماهر في التعامل مع أقسام معينة من البيانات أو مهام محددة. يسمح هذا الترتيب لجيميني 1.5 بالتفاعل بشكل ديناميكي مع الخبير الأكثر ملاءمة بناءً على البيانات الواردة، مما يسهل من قدرة النموذج على التعلم ومعالجة المعلومات.
يرفع هذا النهج المبتكر من كفاءة التدريب والتشغيل للنموذج بشكل كبير من خلال تفعيل الخبراء اللازمين فقط للمهام. وبالتالي، يمكن لجيميني 1.5 السيطرة بسرعة على المهام المعقدة وتقديم نتائج عالية الجودة بشكل أكثر كفاءة من النماذج التقليدية. تتيح هذه التطورات لفريق بحث جوجل تسريع تطوير وتحسين نموذج جيميني، مما يوسع الإمكانيات داخل مجال الذكاء الاصطناعي.
توسيع القدرات
تطور ملحوظ في جيميني 1.5 هو زيادة قدرته على معالجة المعلومات. يمتد نافذة السياق للنموذج، وهو مقدار البيانات التي يمكنه تحليلها ل توليد استجابات، إلى ما يصل إلى مليون رمز – زيادة كبيرة عن 32,000 رمز في جيميني 1.0. يعني هذا أن جيميني 1.5 برو يمكنه معالجة كميات كبيرة من البيانات، مثل ساعة من المحتوى المرئي أو أحد عشر ساعة من الصوت أو قواعد بيانات كبيرة ووثائق نصية. كما تم اختباره بنجاح مع ما يصل إلى 10 ملايين رمز، مما يظهر قدرته الاستثنائية على فهم وتفسير مجموعات بيانات ضخمة.
نظرة على قدرات جيميني 1.5
تتيح التحسينات المعمارية وتوسيع نافذة السياق لجيميني 1.5 أداء تحليل متقدم على مجموعات كبيرة من البيانات. سواء كان ذلك في غوص في تفاصيل مخططات مهمة أبولو 11 أو تفسير فيلم صامت، يظهر جيميني 1.5 قدرات فريدة في حل المشكلات، خاصة مع كتل كبيرة من الشفرة.
تم تطوير جيميني 1.5 برو على معززات TPUv4 المتقدمة من جوجل، وتم تدريبه على مجموعة بيانات متنوعة تشمل مجالات مختلفة ويشمل محتوى متعددة الوضع ومتعدد اللغات. يضمن هذا القاعدة الواسعة للتدريب، بالإضافة إلى التعدين الدقيق بناءً على بيانات تفضيل الإنسان، أن تتوافق مخرجات جيميني 1.5 برو جيدًا مع تصورات الإنسان.
من خلال الاختبارات الشاملة للمقارنة ضد مجموعة من المهام، يتفوق جيميني 1.5 برو ليس فقط على سابقه في معظم التقييمات ولكن أيضًا يقف على قدم المساواة مع نموذج جيميني 1.0 ألترا الأكبر. يظهر جيميني 1.5 برو قدرات قوية في “التعلم في السياق”، حيث يكتسب معرفة جديدة من الإشارات المفصلة دون الحاجة إلى تعديلات إضافية. كان هذا واضحًا بشكل خاص في أدائه على اختبار الترجمة الآلية من كتاب واحد (MTOB)، حيث قام بترجمة من الإنجليزية إلى لغة كالامانغ – لغة يتحدثها عدد قليل من الناس – بمهارة قابلة للمقارنة مع تعلم الإنسان، مما يؤكد مرونته وكفاءة التعلم.
وصول معاينة محدود
يتم تقديم جيميني 1.5 برو الآن في معاينة محدودة للمطورين وعمالقة الشركات من خلال استوديو الذكاء الاصطناعي وفرع الذكاء الاصطناعي، مع خطط لإطلاق أوسع ونخبة قابلة للتخصيص في الأفق. تقدم هذه المرحلة المعاينة فرصة فريدة لاستكشاف نافذة السياق الموسعة، مع تحسينات متوقعة في سرعة المعالجة. يمكن للمطورين وعمالقة الشركات المهتمين بجيميني 1.5 التسجيل من خلال استوديو الذكاء الاصطناعي أو الاتصال بفرق حسابات فرع الذكاء الاصطناعي للحصول على مزيد من المعلومات.
النقطة الأساسية
يمثل جيميني 1.5 خطوة ملحوظة向 الأمام في تطوير الذكاء الاصطناعي المتعدد الوضع. بناءً على الأساس الذي وضعه جيميني 1.0، يأتي هذا الإصدار الجديد مع تحسينات في أساليب معالجة وتكامل البيانات المختلفة. يبرز إدخال نهج معماري جديد وزيادة قدرات معالجة البيانات جهود جوجل المستمرة لتحسين تقنيات الذكاء الاصطناعي. مع إمكاناته المحتملة لمعالجة المهام بشكل أكثر كفاءة وتعلم متقدم، يظهر جيميني 1.5 تطور الذكاء الاصطناعي المستمر. حاليًا، يتم تقديم إصدار معاينة محدود للعديد من المطورين وعمالقة الشركات، مما يشير إلى إمكانيات مثيرة في مستقبل الذكاء الاصطناعي، مع إطلاق أوسع وتحسينات إضافية على الأفق.












