نماذج ومنصات الذكاء الاصطناعي
تقطيع أسعار واجهة برمجة تطبيقات OpenAI على نموذجين أقل تكلفة من GPT-5.6

خفضت OpenAI أسعار واجهة برمجة تطبيقات نموذجي GPT-5.6 الأقل تكلفة في 30 يوليو 2026، حيث خفضت النموذج الأقل تكلفة بنسبة 80٪ والنموذج الأوسط بنسبة 20٪، بينما ظلت أسعار النموذج الرئيسي دون تغيير. تم تسجيل التغيير في سجل تغييرات واجهة برمجة التطبيقات الخاص بالشركة وتم نشره بالفعل على بطاقة الأسعار المنشورة.
لكل مليون رمز إدخال وإخراج، تظهر الأسعار القياسية الآن على النحو التالي:
- GPT-5.6 Luna: 20 سنتًا و 1.20 دولار، انخفاضًا من 1 دولار و 6 دولارات
- GPT-5.6 Terra: 2 دولار و 12 دولار، انخفاضًا من 2.50 دولار و 15 دولار
- GPT-5.6 Sol: 5 دولارات و 30 دولار، بدون تغيير، مطابقًا لأسعار سلفه GPT-5.5
جميع النماذج الثلاثة وصلت إلى توافر عام في 9 يوليو 2026 عند الأسعار الأعلى، مما يجعل إعادة التسعير بعد ثلاثة أسابيع من حياة العائلة التجارية.
القطوع تمتد عبر جميع مستويات الخدمة على الصفحة، وليس فقط السعر المعلن. معالجة Batch و Flex، كلاهما نصف السعر القياسي، يضعان الآن Luna عند 10 سنتات للرمز الإدخال و 60 سنتًا للرمز الإخراج. قراءات الإدخال المخزنة، التي تم خصمها بنسبة 90٪، تنخفض إلى سنتين لكل مليون رمز على Luna و 20 سنتًا على Terra. الطلبات ذات السياق الطويل، التي يتم 청구ها بمعدل مرتين للرمز الإدخال و 1.5 مرة للرمز الإخراج، تصل إلى 40 سنتًا و 1.80 دولارًا ل Luna. المشترين الذين يمررون عبر Amazon Bedrock يتم 청료 من قبل AWS، وتنوه OpenAI إلى أن هذه الأسعار قد تختلف عن أسعارها الخاصة.
النماذج الأقل تكلفة هي حيث تعيش حركة المرور الإنتاجية عالية الحجم: التصنيف، الاستخراج، توجيه الطلب، المسودة الأولى، وال环ات الطويلة للوكيل حيث يمكن أن يؤدي توجيه واحد للمستخدم إلى عشرات من مكالمات النموذج قبل أن يعود بالجواب. القطع الخماسي على النموذج الذي ي흡 thụ هذا الحجم يغير الحسابات التي تحدد أي عمل يُستحق آليًا.
مكان النماذج الأقل تكلفة مقابل Claude
عند 20 سنتًا للرمز الإدخال و 1.20 دولارًا للرمز الإخراج، يقلل Luna من نموذج Haiku 4.5 الأقل تكلفة من Anthropic بنسبة خمس مرات للرمز الإدخال وربع مرة للرمز الإخراج، وفقًا ل صفحة التسعير الخاصة بالشركة. يقع سعر Terra الجديد أقل من 3 دولارات و 15 دولارًا التي يُخطط ل Claude Sonnet 5 أن تفرضها بمجرد انتهاء سعرها الترويجي البالغ 2 دولار و 10 دولارات في 31 أغسطس 2026. في أعلى كل من النماذج، لا يزال Sol أكثر تكلفة على الإخراج من Opus 5، الذي يُصنع من قبل Anthropic بسعر 5 دولارات و 25 دولار.
تتحول معالجة الأولوية إلى وضع السرعة
دخلت نفس مدخل سجل التغييرات تقاعد معالجة الأولوية واستبدلتها بوضع السرعة. ل Sol، تقول OpenAI إن وضع السرعة يعمل بسرعة تصل إلى 2.5 مرة السرعة القياسية بمعدل مرتين، والتحويل متوافق مع الإصدارات السابقة: الطلبات التي تم بالفعل وضع علامة الأولوية عليها تنتقل إلى وضع السرعة دون تغيير في الكود. أسعار وضع السرعة هي 10 دولارات و 60 دولارًا ل Sol، و 4 دولارات و 24 دولارًا ل Terra، و 40 سنتًا و 2.40 دولارًا ل Luna.
تبيع Anthropic نفس المنتج تحت نفس الاسم و نفس الشروط — وضع السرعة ل Opus 5، حتى 2.5 مرة أسرع بمعدل تسعير قياسي مرتين. تتقارب بطاقتي الأسعار الآن على وضع الاستدلال المحدد للمنطقة. تفرض OpenAI زيادة بنسبة 10٪ على النماذج الصادرة في أو بعد 5 مارس 2026 عندما يطلب العميل إقامة بيانات؛ تفرض Anthropic سعرًا يصل إلى 1.1 مرة سعرها القياسي للاستدلال فقط في الولايات المتحدة.
ما الذي جعل النماذج الأقل تكلفة أرخص
نشرت OpenAI حساباتها قبل يوم من القطع. في منشور تقني في 29 يوليو 2026، واصفًا خمس أعضاء من الموظفين الفنيين تحسينات عبر الاستدلال و حزام الوكيل خلف Codex و ChatGPT Work. Sol، الذي يعمل داخل Codex، أعاد كتابة نواة GPU الإنتاج الخاصة بالشركة؛ مع العمل الأوسع على النواة، تقول OpenAI إن ذلك قطع التكاليف الشاملة للخدمة بنسبة 20٪. كما قام Sol بتصميم نموذج التشفير التكيفي الخاص به عبر مئات التجارب، والتي تُ归زها الشركة إلى زيادة كفاءة إنشاء الرموز بنسبة أكثر من 15٪.
هذه هي أرقام OpenAI الخاصة بنفسها. انتهى المنشور بالالتزام بنقل “التحسينات التي تتم تحت الغطاء إلى مستخدمينا و عملائنا في شكل ذكاء أكثر انتشارًا و كفاءة في التكلفة”. تبعت بطاقة الأسعار بعد يوم.
يشير عمل الحزام إلى نفس مركز التكلفة الذي يؤدي إليه القطع. تقوم OpenAI بتحديد输出 الأداة افتراضيًا عند 10,000 رمز و تحتفظ بسجل تاريخي قابل للتعديل، لذلك يمكن لل环 الوكيل إعادة إرسال تعليماته وتعريفاته في كل خطوة و يضرب ذاكرة الإدخال بدلاً من دفع أسعار الإدخال الكاملة. على مهمة تستغرق 30 طلبًا للنموذج، هناك 30 فرصة لتجنب إعادة الحساب لنفس البادئة.
تقع القطع أثناء قيام المشترين بمراجعة إنفاق الاستدلال وتوسيع الفرق التي تلمس النماذج: وجد بحث OpenAI الخاص أن الموظفين يستخدمون ChatGPT خارج مسمى عملهم. انتقلت منظمة الهندسة في Amazon لتحديد حد لإنفاق الذكاء الاصطناعي في نفس اليوم، وأصدرت OpenAI حدود إنفاق قاسية لمنظمات واجهة برمجة التطبيقات و المشاريع في 22 يوليو 2026، مما يسمح للمسؤولين بتحديد سقف شهري يبدأ في إرجاع أخطاء بمجرد وصول الإنفاق المتابع إليه.
لمنظمة توجيه العمل بالجملة إلى Luna، تكلفت المكالمات نفسها الآن خمس ما كانت عليه، مع سقف يمكنهم تعيينه في لوحة التحكم. مع عدم تغيير سعر Sol، يبقى القرار الحي حيث وضعت OpenAI منذ إطلاق العائلة: أي مستوى يتطلب كل طلب.












