نماذج ومنصات الذكاء الاصطناعي

يسمح جوجل للمطورين بحظر مكالمات أدوات وكلاء Gemini

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

أضاف جوجل طبقة تحكم إلى الوكلاء المدارة في واجهة برمجة تطبيقات Gemini، مما يسمح للمطورين بتشغيل كودهم الخاص قبل وبعد كل مكالمة أداة يقوم بها الوكيل داخل شبكة رمله، ويلغي المكالمة تمامًا. التحديث نفسه يجعل Gemini 3.6 Flash النموذج الافتراضي خلف الوكيل، وحدود عدد الرموز التي يمكن لأداة واحدة استهلاكها، وفتح الميزة للمشاريع التي لا توجد لديها فواتير.

الوكلاء المدارة هي نسخة جوجل المضيفة من حلقة الوكيل، نفس النمط وراء المساعدين الذين يتم توصيلهم الآن لتنفيذ الإجراءات بدلاً من الإجابة على الأسئلة. مكالمة واجهة برمجة تطبيقات واحدة تُؤمن حاوية رملية لينكس، ثم يخطط النموذج، وينفذ التعليمات البرمجية، وينصب الحزم، ويكتب ويكتب الملفات، ويتصل بالصفحات الويب حتى يتم الانتهاء من المهمة. هذا الهيكل هو ما جعل الميزة الجديدة ضرورية: كانت الحاوية رملية مكانًا يمكن للمطورين إرسال العمل إليه ولكن لا يستطيعون ضبطه من الداخل.

تغير Hooks ذلك. ملف hooks.json المثبت في الحاوية رملية يسجل معالجات ضد لحظتين في الحلقة: قبل تشغيل أداة وبعدها. لكل قاعدة تطابق أسماء الأدوات بواسطة تعبير منتظم، لذلك يمكن لدخول واحد تغطية تنفيذ التعليمات البرمجية وكتابة الملفات معًا أو اعتراض كل مكالمة. عندما يعود معالج ما قبل التنفيذ برفض، ي 跳ز Runtime مكالمة الأداة ويعيد سبب الإلغاء إلى سياق النموذج، حيث يمكن للوكيل اختيار مسار مختلف أو شرح الحظر للمستخدم داخل نفس الدورة.

ما يصل إليه Hooks

تشتعل Hooks على الأدوات التي تقوم جوجل بتشغيلها داخل الحاوية: تنفيذ التعليمات البرمجية، بالإضافة إلى عمليات نظام الملفات التي تقرأ وكتابة الملفات وقائمة الملفات وحذفها. الوظائف المخصصة التي ينفذها المطور على جانب العميل وخادم بروتوكول سياق النموذج عن بُعد لا يتم اعتراضها.

النكسات تتحول نحو الأذن. إذا خرج سكريبت Hook بخطأ، أو انتهى الوقت، أو أعاد خطأ الخادم، أو أرسل JSON لا يعرفه Runtime، فإن مكالمة الأداة تذهب. توفر وثائق جوجل السبب: يجب ألا يكون لينتر مكسور أو خادم تелеметري غير متاح أبدًا القدرة على تعطيل تطبيق إنتاج.

نوع المعالج الثاني يرسل الحدث مباشرة إلى نقطة نهاية خارجية من داخل شبكة الحاوية رملية، وهو كيفية عمل تسجيل المراجعة. هذه الطلبات تسافر عبر وكيل إخراج جوجل، لذلك يجب أن يكون الوجهة موجودًا في قائمة السماح بالبيئة، وتعيش رموز التحقق في تكوين الشبكة بدلاً من ملف Hook، مع حقن الوكيل رؤوس حقيقية على السلك. كما يشير جوجل إلى أن وكيلًا يحمل الوصول إلى Shell أو الكتابة يمكنه تعديل ملف Hook في مساحة عمل قابلة للكتابة، ويشير المطورين الذين يحتاجون إلى مقاومة التلاعب إلى تثبيت تلك التكوين من مستودع قابل للقراءة فقط.

مراقبة ما يُسمح للوكيل بفعله هو جذب أموال الاستثمار الخاصة به. جوجل يضع الفحص داخل وقت تشغيله.

أنابيب التحقق هي أول استخدام أضيف إليه اسم العميل. قال Alston Lin، المؤسس والمدير التقني للبنك الاستثماري المحلي OffDeal، إن Hook ما بعد التنفيذ يدير الآن خط أنابيب فحص الصور الخاصة به في لحظة كتابته قائمة الشركات، وينفذ قواعد جودة على مستوى البكسل على العشرات من الشعارات التي تحتاجها عارضة مصرفية جاهزة. “قبل Hooks الوكيل، لم نستطع القيام بذلك على وكلاء Gemini المدارة: الحاوية رملية بعيدة، لذلك لم يكن لدينا رمز التحقق مكانًا للتشغيل”، قال.

Gemini 3.6 Flash يأخذ مكان الافتراضي

الوكيل المدارة يدير Gemini 3.6 Flash دون أي تغيير في الكود، ويتخذه في التفاعل التالي. يمكن للمطورين تثبيت نموذج مختلف عن طريق تمريره في تكوين الوكيل، واختيار Gemini 3.5 Flash من أجل الاستمرارية أو 3.5 Flash-Lite من أجل التكلفة والاتساق الأقل.对于 وكلاء محفوظين كمورد دائم، يتم تثبيت النموذج عند إنشائه ولا يمكن إلغاءه لكل مكالمة، وهو ما يقول جوجل إنه يحافظ على سلوك مكالمة الأداة، وحدود التصحيح والأمان قابل للتنبؤ.

أصدر جوجل 3.6 Flash في 21 يوليو 2026 إلى جانب 3.5 Flash-Lite و 3.5 Flash Cyber الأمني، وهو الإطلاق الذي أجّل فيه إطلاق 3.5 Pro الرائد مرة أخرى. يُصنّف بسعر 1.50 دولار لكل مليون رمز إدخال و 7.50 دولار لكل مليون رمز إخراج، مقابل 9.00 دولار للخروج من 3.5 Flash، وتقارير الشركة أنه يستهلك 17٪ أقل من رموز الإخراج على فهرس التحليل الاصطناعي ويتحصل على 49٪ على اختبار الترميز DeepSWE مقابل 37٪ لسابقه. الملف الشخصي الأرخص للرمز هو الجزء الذي يهم داخل حلقة الوكيل، حيث يمكن أن تدير المهمة مئات الخطوات.

حدود الإنفاق والتشغيل المجدول

التكلفة هي الشيء الآخر الذي يعالجه هذا الإصدار مباشرة. سقف الرمز الممرر مع الطلب يحدد رموز الإدخال والإخراج والتفكير عبر التفاعل بأكمله؛ يتم استبعاد الرموز المخبأة، والحد هو أفضل جهد وليس دقيقًا. عندما يصل الوكيل إلى الحد، يعود التشغيل غير مكتمل مع حالة الحاوية رملية سليمة، ويستأنف المكالمة التالية العمل بسماح جديد. تقديرات جوجل الخاصة تضع مهمة معالجة البيانات الكثيفة عند 0.70 دولار إلى 3.25 دولار، مع تجميع سير العمل المعقد ملايين الرموز الثلاثة إلى الخمس و 5 دولارات تقريبًا في التفاعل الواحد. لا يتم فواتير الحوسبة رملية خلال العرض التوضيحي.

إضافتان تحولان الوكيل إلى بنية تحتية دائمة بدلاً من مكالمة لكل طلب:

  • محددات المواعيد يربط وكيلًا، وطرفًا، وبيئة، وتعبير cron في مورد دائم يطلق تلقائيًا، ويتوقف تلقائيًا بعد خمسة فشل متتالي. كل تشغيل يعيد استخدام نفس الحاوية رملية، لذلك تكون الملفات المكتوبة بواسطة تنفيذ واحد مرئية للتنفيذ التالي.
  • واجهة بيئات تقوم بتحديث القوائم، وتفتيش، وحدف جلسات الحاوية رملية من الكود، وتستعيد معرف البيئة بعد انقطاع الاتصال، وتنظيف الحاويات رملية عند انتهاء خط أنابيب بدلاً من انتظار انتهاء صلاحيتها بعد سبعة أيام.

تعتمد الميزات على إصدار 7 يوليو 2026 الذي قدم وكلاء إدارة الخلفية، ووصلات بروتوكول سياق النموذج عن بُعد، ودعوة الوظائف المخصصة، وتجديد أذونات الجلسة. معًا، وضعوا وكيلًا مجدولًا، ومحدودًا بميزانية، وطبقة سياسة قابلة للتنفيذ في متناول مطور يعمل من مفتاح واجهة برمجة تطبيقات مجاني.

جوناس ريف هو محلل منشأ بالذكاء الاصطناعي في Unite.AI، يركز على الذكاء الاصطناعي الإدراكي والذكاء الاصطناعي العام (AGI) والأسس النظرية للذكاء الآلي. يعمل على كيفية ظهور التعلم والاستدلال والذاكرة والاستخراج في الأنظمة البيولوجية والاصطناعية، ورسم الصلات بين هياكل الذكاء الاصطناعي الحديثة والأسئلة القديمة في العلوم الإدراكية وفلسفة العقل.
مع نهج概念ي واعٍ، يبحث جوناس في الإطارات مثل نماذج الاستدلال والأنظمة الوكيلية والاعتراف الناشئ ونظرية التوجيه، بهدف توضيح ما يعنيه التقدم نحو AGI بالفعل - وما لا يعنيه. بدلاً من مطاردة الجداول الزمنية أو الهياج، يؤكد على المبادئ الأولى والصقل المفاهيمي وحدود النماذج الحالية.
المقالات التي كتبها جوناس ريف هي منشأة بالذكاء الاصطناعي ومراجعة بواسطة فريق تحرير Unite.AI لضمان الدقة والوضوح والمناقشة المسؤولة للمفاهيم المتقدمة للذكاء الاصطناعي.