نماذج ومنصات الذكاء الاصطناعي
إطلاق Nano Banana 2.1 بنصف تكلفة الصورة مقارنة بسلفه

أصدرت Google نموذج Nano Banana 2.1، وهو نموذج لتوليد الصور وتحريرها يعتمد على Gemini 3.6 Flash، في 6 أكتوبر 2026، مع توفره عبر تطبيق Gemini، وGoogle AI Studio، وGemini API، ومنصة Gemini Enterprise Agent، وتكلفة إخراج الصور عبر واجهة برمجة التطبيقات ذات المستوى المدفوع هي $30 لكل مليون رمز.
تم نشر بطاقة نموذج Nano Banana 2.1 في نفس اليوم، وتصف النموذج كعضو في سلسلة Gemini 3 من نماذج التفكير متعددة الوسائط الأصلية. يقبل النصوص والصور كمدخلات مع نافذة سياق تصل إلى مليون رمز، ويولد مخرجات صورة ونص، مُدرجة بمخرجات 4K رمز و64K رمز على التوالي. تُدرج البطاقة التوزيع عبر تطبيق Gemini، وGoogle AI Studio، وGemini API، ووضع AI في بحث Google، وGoogle Ads، وGoogle Flow، وGoogle Stitch.
مواصفات منصة المؤسسات
على منصة Gemini Enterprise Agent، يحمل النموذج المعرف gemini-nano-banana-2.1 في مرحلة الإطلاق المتاح للجميع، مع تاريخ إصدار مدرج في 6 أكتوبر 2026. توثيق المنصة من Google يصف Nano Banana 2.1 بأنه مُحسّن لتوليد الصور متعددة الوسائط وتحريرها، مقدماً توازناً بين السعر والأداء.
تشير الوثائق إلى أن النص والصورة مدعومان كمدخلات ومخرجات، بينما الفيديو مدخل فقط، والصوت غير متوفر، مع نافذة سياق تبلغ 131,072 رمز وحد أقصى من 32,768 رمز للمخرجات. لا تُدعم معلمات seed وtopK وlogprobs وtemperature وtopP، وعند ضبط أي منها تُرجع خطأً في واجهة برمجة التطبيقات.
تشمل الميزات المدعومة التفكير، وتعليمات النظام، وتخزين السياق الضمني مؤقتًا، وحساب الرموز، والربط مع بحث Google والبحث عن الصور، وتوفير معدل نقل مخصص، والاستدلال الدفعي، والنموذج القياسي الدفع حسب الاستخدام، مع توفر عالمي. يُدعم توليد الصور، بما في ذلك من مدخلات الفيديو، وتحرير الصور والتحرير متعدد الجولات، وتداخل الصورة والنص، واعتمادات المحتوى (C2PA)، وتجربة الملابس الافتراضية؛ بينما لا يتوفر توليد الأشخاص.
تشمل الحدود 14 صورة لكل طلب، و7 ميغابايت لكل ملف للبيانات المضمنة أو تحميلات وحدة التحكم، و30 ميغابايت لكل ملف من التخزين السحابي، وحد حجم إدخال 500 ميغابايت. تشمل نسب الأبعاد المدعومة 1:1، 3:2، 4:3، 16:9، 9:16، و21:9، مع دقات 1K و2K و4K ودعم صيغ png وjpeg وwebp وheic وheif. تشير الوثائق إلى أن النموذج يستهلك 1,120 رمز لكل صورة إدخال، بينما تستهلك صور الإخراج 1,120 رمز بدقة 1K و1,680 رمز بدقة 2K.
أسعار Gemini API
تصف صفحة تسعير Gemini API التي حدّثتها Google في 6 أكتوبر 2026، Nano Banana 2.1 بأنه “تحديث لـ Nano Banana 2 (Gemini 3.1 Flash Image)”، صُمم لتوليد الصور عالية الكفاءة والتحرير الحواري مع تحسين جودة الصورة، واتساق الشخصية عبر جولات متعددة، وعرض نص دقيق، وتوليد مستند إلى البحث عبر دقات 1K و2K و4K. تُدرج أسعار المستوى المدفوع القياسي كالتالي: $1.50 لكل مليون رمز إدخال للنص والصورة والفيديو، $7.50 لكل مليون رمز إخراج للنص والتفكير، و$30.00 لكل مليون رمز لإخراج الصور، حيث تعادل الصفحة $0.0336 لكل صورة بدقة 1K، $0.0504 لكل صورة بدقة 2K، و$0.0756 لكل صورة بدقة 4K.
تُدرج أسعار الدفعات كالتالي: $0.75 لكل مليون رمز إدخال، $3.75 لكل مليون رمز لإخراج النص والتفكير، و$15.00 لكل مليون رمز صورة، مع ما يعادل $0.0168 و$0.0252 و$0.0378 لكل صورة بدقة 1K و2K و4K على التوالي. يتيح الربط مع بحث Google على الويب والبحث عن الصور 5,000 طلب مجاني شهريًا مشتركة بين نماذج Gemini 3.x، ثم $14 لكل 1,000 طلب. لا تُدرج الصفحة أي وصول مجاني للمستوى الأساسي لـ Nano Banana 2.1.
تُدرج الصفحة نفسها السلف، Gemini 3.1 Flash Image (Nano Banana 2)، بسعر $0.50 لكل مليون رمز إدخال، $3 لكل مليون رمز لإخراج النص والتفكير، و$60.00 لكل مليون رمز صورة، مع ما يعادل $0.067 لكل صورة بدقة 1K، $0.101 لكل صورة بدقة 2K، و$0.151 لكل صورة بدقة 4K.
التقييمات المبلّغ عنها
تشير بطاقة النموذج إلى نهج تقييم يجمع بين تقييم بشري جنبًا إلى جنب ينتج درجات إيلو عبر مهام النص إلى صورة والتحرير، ومُقَيِّم AutoRater أحادي الجانب للحقائق، ومجموعات انحدار مستمدة من Gemini 2.5 Flash صورة وحالات استخدام Gemini 3 Pro Image.
في مهمة النص إلى صورة، تُبلغ البطاقة عن إيلو التفضيل العام 1050 ±14 لـ Nano Banana 2.1 في وضعية Thinking و1015 ±13 بدون التفكير، مقارنةً بـ 990 ±7 لـ Nano Banana 2 (Thinking) و935 ±8 لـ Gemini 3 Pro صورة (Nano Banana Pro). تُذكر درجات تصميم الإنفوجرافيك 1048 ±17 للوضعية Thinking، مقابل 961 ±12 لـ Nano Banana 2 و912 ±12 لـ Nano Banana Pro، بينما تُسجل دقة الإنفوجرافيك 0.521 مقارنةً بـ 0.179 و0.265.
في تحرير الوضعية Thinking، تُبلغ البطاقة عن Nano Banana 2.1 بـ 1026 للتحرير العام، 1028 لتناسق الشخصية الواحدة، 1106 لتناسق متعدد الشخصيات، 1049 للتحرير القائم على القناع/الحبر، 1024 لتناسق المنتج، 1062 للتصميم الفني، و1066 للتحرير متعدد المراجع، كلٌ منها مُدرج أعلى من درجات Nano Banana 2 وNano Banana Pro المقابلة في نفس الجدول.
القيود وتقييمات السلامة
تُدرج البطاقة القيود المعروفة بما في ذلك الهلوسة، البطء أو الانقطاعات العرضية، ضعف عرض النص الصغير والفقرات الطويلة، عدم اتساق الأحرف بين الإدخال والصور المُولَّدة، اتباع جزئي للتعليمات واستمرار الحبر في التحرير المقنَّع، حالات نادرة من بقاء وضعية الموضوع ثابتة أثناء التحرير، ارتباك عرضي حول التحديد المكاني، ومحدودية المعرفة العالمية، التفكير ثلاثي الأبعاد، والواقعية. Gemini 3.6 Flash لديها حد معرفة حتى مارس 2026، رغم أن البطاقة تشير إلى أنه في بعض المجالات قد تكون المعرفة محدودة حتى يناير 2025.
تشير البطاقة إلى إجراء اختبار Red Team يدوي من قبل فرق متخصصة خارج فريق تطوير النموذج، وتذكر أن Nano Banana 2.1 استوفى عتبات الأمان الخاصة بالأطفال المطلوبة للإطلاق، وتصف أداءها السلامي بأنه مشابه أو محسّن مقارنةً بـ Gemini 3 Flash، دون وجود مخاوف جسيمة تم العثور عليها بالنسبة إلى Gemini 3.1 Pro. بالنسبة لأمان الحدود المتقدمة، تشير البطاقة إلى أن Gemini 3.1 Pro و Gemini 3.7 Flash لم يحققا أي مستويات قدرة متتبعة أو حرجة، وأن Nano Banana 2.1 لا تظهر أي قدرات جديدة ذات معنى أو تحسينات ملحوظة في الأداء مقارنةً بتلك النماذج، مما يجعل تقييمها على أنه من غير المرجح أن تصل إلى أي من هذه المستويات.












