نماذج ومنصات الذكاء الاصطناعي
إطلاق GPT-4o Mini: بديل فعال من حيث التكلفة وعالية الأداء ل Claude Haiku و Gemini Flash و GPT 3.5 Turbo
أعلنت OpenAI، الشركة الرائدة في مجال توسيع نماذج Transformer المتدربة بشكل عام (GPT)، عن إطلاق GPT-4o Mini، مما يشير إلى تحول نحو حلول ذكاء اصطناعي أكثر ضيقًا. هذا التحول يعالج تحديات الذكاء الاصطناعي على نطاق كبير، بما في ذلك التكاليف العالية وعمليات التدريب التي تستهلك الكثير من الطاقة، ويوفر لمشروع OpenAI فرصة للتنافس مع منافسيه مثل جوجل و Claude. يوفر GPT-4o Mini نهجًا أكثر كفاءة وتكلفة فيما يتعلق بالذكاء الاصطناعي المتعدد الوسائط. سوف نستكشف في هذا المقال ما يميز GPT-4o Mini من خلال مقارنته مع Claude Haiku و Gemini Flash و GPT-3.5 Turbo من OpenAI. سنقيم هذه النماذج بناءً على ستة عوامل رئيسية: دعم الوسائط، والأداء، ونافذة السياق، وسرعة المعالجة، والتكلفة، وسهولة الوصول، والتي تعتبر جميعها حاسمة لاختيار النموذج الصحيح للذكاء الاصطناعي لاستخدامات مختلفة.
إطلاق GPT-4o Mini:
GPT-4o Mini هو نموذج ذكاء اصطناعي متعدد الوسائط مضغوط، يمتاز بالقدرة على فهم النص والرؤية. على الرغم من أن OpenAI لم تشارك تفاصيل محددة حول طريقة تطويره، فإن GPT-4o Mini يبني على أساس سلسلة GPT. وهو مصمم لتطبيقات فعالة من حيث التكلفة وذات زمن استجابة منخفض. يُستخدم GPT-4o Mini في المهام التي تتطلب ربط أو تتابع عدة مكالمات نموذجية، أو التعامل مع كميات كبيرة من السياق، وتقديم استجابات نصية سريعة في الوقت الفعلي. هذه الميزات حاسمة بشكل خاص في بناء تطبيقات مثل نظم توليد المعزز بالاسترجاع (RAG) والrobots المحادثة.
الميزات الرئيسية ل GPT-4o Mini تشمل:
- نافذة سياق تصل إلى 128 ألف رمز
- دعم لما يصل إلى 16 ألف رمزخرج لكل طلب
- تعامل محسّن مع النص غير الإنجليزي
- معرفة حتى أكتوبر 2023
GPT-4o Mini مقابل Claude Haiku مقابل Gemini Flash: مقارنة بين نماذج الذكاء الاصطناعي المتعددة الوسائط الصغيرة
يقارن هذا القسم GPT-4o Mini بنموذجين صغيرين آخرين للذكاء الاصطناعي المتعدد الوسائط: Claude Haiku و Gemini Flash. أطلقت Anthropic Claude Haiku في مارس 2024، وأطلقت جوجل Gemini Flash في ديسمبر 2023 مع إصدار محدث 1.5 في مايو 2024، وهي منافسين مهمين.
- دعم الوسائط: يدعم GPT-4o Mini و Claude Haiku حاليًا القدرات النصية والصورة. تخطط OpenAI لإضافة دعم الصوت والفيديو في المستقبل. في المقابل، يدعم Gemini Flash بالفعل النص والصورة والفيديو والصوت.
- الأداء: قامت باحثو OpenAI بتحديد معايير أداء GPT-4o Mini مقابل Gemini Flash و Claude Haiku عبر عدة معايير رئيسية. يتفوق GPT-4o Mini باستمرار على منافسيه. في المهام المتعلقة بالاستدلال النصي والرؤية، سجل GPT-4o Mini 82.0% في MMLU، متجاوزًا 77.9% ل Gemini Flash و 73.8% ل Claude Haiku. سجل GPT-4o Mini 87.0% في الرياضيات والبرمجة على MGSM، مقارنةً بـ 75.5% ل Gemini Flash و 71.7% ل Claude Haiku. على HumanEval، الذي يقيس أداء البرمجة، سجل GPT-4o Mini 87.2%، متقدمًا على Gemini Flash عند 71.5% و Claude Haiku عند 75.9%. بالإضافة إلى ذلك، يمتاز GPT-4o Mini بالتفوق في الاستدلال المتعدد الوسائط، حيث سجل 59.4% على MMMU، مقارنةً بـ 56.1% ل Gemini Flash و 50.2% ل Claude Haiku.
- نافذة السياق: تتيح نافذة السياق الأكبر للنموذج تقديم إجابات متسقة ومفصلة عبر فترات زمنية أطول. يوفر GPT-4o Mini نافذة سياق تصل إلى 128 ألف رمز، ويدعم حتى 16 ألف رمزخرج لكل طلب. يمتلك Claude Haiku نافذة سياق أطول تصل إلى 200 ألف رمز، ولكنه يعود بعدد أقل من الرموز لكل طلب، مع أقصى حد يصل إلى 4096 رمز. يتفوق Gemini Flash بشكل كبير على GPT-4o Mini من حيث نافذة السياق، حيث يصل إلى مليون رمز.
- سرعة المعالجة: يتفوق GPT-4o Mini على النماذج الأخرى من حيث السرعة. حيث يقوم بمعالجة 15 مليون رمز في الدقيقة، بينما يقوم Claude Haiku بمعالجة 1.26 مليون رمز في الدقيقة، و Gemini Flash بمعالجة 4 ملايين رمز في الدقيقة.
- التكلفة: يُعد GPT-4o Mini أكثر كفاءة في التكلفة، حيث يُحدد سعره عند 15 سنتًا لكل مليون رمز إدخال و 60 سنتًا لكل مليون رمزخرج. يُكلّف Claude Haiku 25 سنتًا لكل مليون رمز إدخال و 1.25 دولار لكل مليون رمزخرج. ويُكلّف Gemini Flash 35 سنتًا لكل مليون رمز إدخال و 1.05 دولار لكل مليون رمزخرج.
- سهولة الوصول: يمكن الوصول إلى GPT-4o Mini من خلال واجهة برمجة التطبيقات Assistants و واجهة برمجة التطبيقات Chat Completions و واجهة برمجة التطبيقات Batch. يمكن الوصول إلى Claude Haiku من خلال اشتراك Claude Pro على claude.ai وواجهة برمجة التطبيقات الخاصة به، و Amazon Bedrock و Google Cloud Vertex AI (GOOGL ). يمكن الوصول إلى Gemini Flash على Google AI Studio وتكاملها في التطبيقات من خلال واجهة برمجة التطبيقات الخاصة ب Google، مع توفر إضافي على Google Cloud Vertex AI.
في هذه المقارنة، يبرز GPT-4o Mini بتوازنه في الأداء والكفاءة والتكلفة، مما يجعله منافسًا قويًا في سوق نماذج الذكاء الاصطناعي المتعددة الوسائط الصغيرة.
GPT-4o Mini مقابل GPT-3.5 Turbo: مقارنة مفصلة
يقارن هذا القسم GPT-4o Mini بنموذج GPT-3.5 Turbo من OpenAI، وهو نموذج ذكاء اصطناعي متعدد الوسائط كبير شائع الاستخدام.
- الحجم: على الرغم من أن OpenAI لم تكشف عن عدد المعاملات الدقيقة ل GPT-4o Mini و GPT-3.5 Turbo، إلا أنه من المعروف أن GPT-3.5 Turbo يصنف على أنه نموذج متعدد الوسائط كبير، بينما يصنف GPT-4o Mini على أنه نموذج متعدد الوسائط صغير. هذا يعني أن GPT-4o Mini يتطلب موارد حسابية أقل بكثير من GPT-3.5 Turbo.
- دعم الوسائط: يدعم GPT-4o Mini و GPT-3.5 Turbo المهام المتعلقة بالنص والصورة.
- الأداء: يُظهر GPT-4o Mini تحسينات ملحوظة على GPT-3.5 Turbo في عدة معايير مثل MMLU و GPQA و DROP و MGSM و MATH و HumanEval و MMMU و MathVista. يتفوق في الذكاء النصي والاستدلال المتعدد الوسائط، متجاوزًا باستمرار GPT-3.5 Turbo.
- نافذة السياق: يوفر GPT-4o Mini نافذة سياق أطول بكثير من سعة GPT-3.5 Turbo البالغة 16 ألف رمز، مما يسمح له بالتعامل مع نصوص أطول وتقديم استجابات مفصلة ومتسقة عبر فترات زمنية أطول.
- سرعة المعالجة: يقوم GPT-4o Mini بمعالجة الرموز بسرعة 15 مليون رمز في الدقيقة، متجاوزًا بذلك 4,650 رمزًا في الدقيقة التي يقوم بها GPT-3.5 Turbo.
- التكلفة: يُعد GPT-4o Mini أكثر كفاءة في التكلفة، حيث يُكلّف أكثر من 60% أقل من GPT-3.5 Turbo. يُكلّف 15 سنتًا لكل مليون رمز إدخال و 60 سنتًا لكل مليون رمزخرج، بينما يُكلّف GPT-3.5 Turbo 50 سنتًا لكل مليون رمز إدخال و 1.50 دولار لكل مليون رمزخرج.
- قدرات إضافية: تشير OpenAI إلى أن GPT-4o Mini يتفوق على GPT-3.5 Turbo فيما يتعلق bằng الدعوة إلى الوظائف، مما يسمح بالتكامل الأسهل مع الأنظمة الخارجية. بالإضافة إلى ذلك، يُعد أداءه المتحسن في السياقات الطويلة يجعل منه أداة أكثر كفاءة ومتعددة الاستخدامات لمختلف تطبيقات الذكاء الاصطناعي.
الخلاصة
يمثل إطلاق OpenAI ل GPT-4o Mini تحولًا استراتيجيًا نحو حلول ذكاء اصطناعي أكثر ضيقًا وتكلفة. هذا النموذج يعمل على معالجة تحديات التكاليف التشغيلية العالية وعمليات التدريب التي تستهلك الكثير من الطاقة المرتبطة بأنظمة الذكاء الاصطناعي على نطاق كبير. يمتاز GPT-4o Mini بأدائه وسرعته وتكلفته مقارنةً بالمنافسين مثل Claude Haiku و Gemini Flash. كما يُظهر قدرات متفوقة على GPT-3.5 Turbo، مع ميزات ملحوظة في معالجة السياق والكفاءة في التكلفة. يجعل ذلك من GPT-4o Mini خيارًا قويًا للمطورين الذين يبحثون عن ذكاء اصطناعي متعدد الوسائط وعالي الأداء.












