एआई मॉडल और प्लेटफ़ॉर्म
AWS ने ऑस्ट्रेलियाई क्षेत्रों से Amazon Bedrock पर GPT-5.6 पहुंच खोली

Amazon Web Services ने 2 सितंबर 2026 को कहा कि ऑस्ट्रेलिया की टीमें अब OpenAI के GPT-5.6 मॉडल को Amazon Bedrock पर एक्सेस कर सकती हैं, और एशिया‑पैसिफिक (सिडनी) तथा एशिया‑पैसिफिक (मेलबर्न) क्षेत्रों से Sol, Terra, और Luna वैरिएंट को वैश्विक क्रॉस‑रीजन इन्फरेंस के माध्यम से बुला सकती हैं।
इस व्यवस्था के तहत, एक एप्लिकेशन सिडनी या मेलबर्न में स्थित Amazon Bedrock Runtime एन्डपॉइंट को कॉल करता है, और Bedrock अनुरोध को प्रोसेसिंग के लिए समर्थित व्यावसायिक AWS रीजन में रूट करता है। AWS ने कहा कि इससे ऑस्ट्रेलियाई ग्राहकों को व्यापक क्षमता पूल तक पहुंच मिलती है, बिना एप्लिकेशन को गंतव्य रीजन रूटिंग प्रबंधित करने की आवश्यकता के। तीन वैश्विक इन्फरेंस प्रोफ़ाइल मॉडल को कवर करती हैं: global.openai.gpt-5.6-sol, global.openai.gpt-5.6-terra, और global.openai.gpt-5.6-luna। सिडनी का रीजन कोड ap-southeast-2 है और मेलबर्न का ap-southeast-4।
तीन GPT-5.6 वैरिएंट्स
AWS ने इन तीन वैरिएंट्स को विभिन्न कार्यभार प्रोफ़ाइलों के अनुरूप बताया। AWS Machine Learning Blog post के अनुसार, GPT-5.6 Sol जटिल तर्क, कोडिंग और एजेंटिक कार्यभार के लिए उपयुक्त है; Terra दैनिक उत्पादन उपयोग के लिए प्रदर्शन और लागत के बीच संतुलन बनाता है; और Luna उच्च‑वॉल्यूम और लेटेंसी‑संवेदनशील अनुप्रयोगों के लिए तेज़, किफायती इन्फरेंस प्रदान करता है। सभी तीन टेक्स्ट और इमेज इनपुट स्वीकार करते हैं, टेक्स्ट उत्पन्न करते हैं, और 1 मिलियन टोकन तक के कॉन्टेक्स्ट विंडो का समर्थन करते हैं।
इन दो ऑस्ट्रेलियाई क्षेत्रों से, डेवलपर्स मॉडल को Bedrock Runtime एन्डपॉइंट पर तीन एक्सेस पाथ्स के माध्यम से बुला सकते हैं: OpenAI Responses API, OpenAI Chat Completions API, और Amazon Bedrock Converse API। OpenAI‑संगत API को एन्डपॉइंट के /openai/v1 पाथ पर कॉल किया जाता है, न कि AWS SDKs के माध्यम से, और एन्डपॉइंट या तो AWS Signature Version 4 साइनिंग या Amazon Bedrock मॉडल इन्फरेंस API कुंजी को स्वीकार करता है।
GPT-5.6 के लिए प्रॉम्प्ट कैशिंग समर्थित API के माध्यम से दो मोड में उपलब्ध है। इम्प्लिसिट कैशिंग डिफ़ॉल्ट रूप से सक्षम रहती है और कोड में कोई परिवर्तन आवश्यक नहीं होता, जबकि एक्स्प्लिसिट कैशिंग डेवलपर्स को पुन: उपयोग योग्य प्रीफ़िक्स, कैश सीमा, और कैश कुंजी परिभाषित करने की अनुमति देती है। AWS ने नोट किया कि प्रोफ़ाइल सदस्यता और मॉडल उपलब्धता बदल सकती है, और ग्राहक को तैनाती से पहले कॉन्फ़िगरेशन सत्यापित करने के लिए अपने cross-Region inference support documentation की ओर निर्देशित किया।
Codex एकीकरण और OIDC प्रमाणीकरण
OpenAI के Codex कोडिंग एजेंट नवीनतम Codex CLI में निर्मित Bedrock Runtime मॉडल प्रोवाइडर के माध्यम से वही वैश्विक इन्फरेंस प्रोफ़ाइल उपयोग कर सकता है। AWS ने कहा कि उसने codex-cli 0.149.1 के साथ कॉन्फ़िगरेशन को सत्यापित किया, जो सिडनी से GPT-5.6 Sol चला रहा था।
उन संगठनों के लिए जो Okta, Auth0, Microsoft Entra ID, Amazon Cognito, या AWS IAM Identity Center के माध्यम से पहचान को फेडरेट करते हैं, AWS एक नमूना क्रेडेंशियल हेल्पर प्रदान करता है जो OpenID Connect टोकन को अस्थायी AWS क्रेडेंशियल्स में बदलता है। Codex फिर इन क्रेडेंशियल्स को मानक AWS क्रेडेंशियल चेन के माध्यम से पढ़ता है, और अनुरोध SigV4 से साइन होते हैं, इसलिए इन्फरेंस पाथ में कोई API कुंजी शामिल नहीं होती। जब प्रोफ़ाइल IAM Identity Center द्वारा समर्थित होती है, तो क्रेडेंशियल्स पहले से ही अल्पकालिक होते हैं और सिंगल साइन‑ऑन सत्र के साथ घुमाते हैं।
ऑस्ट्रेलियाई डिप्लॉयमेंट के लिए पूर्वापेक्षाएँ शामिल हैं: सिडनी या मेलबर्न को स्रोत रीजन के रूप में सक्षम वाला AWS खाता, GPT-5.6 इन्फरेंस प्रोफ़ाइल को बुलाने की अनुमति वाला IAM रोल या यूज़र, तथा Python 3.9 या उससे ऊपर, जिसमें openai, boto3, और aws-bedrock-token-generator पैकेज स्थापित हों। सर्विस कंट्रोल पॉलिसी उपयोग करने वाले संगठनों को यह सत्यापित करना चाहिए कि उनकी पॉलिसी चयनित स्रोत रीजन में GPT-5.6 वैश्विक इन्फरेंस प्रोफ़ाइल की अनुमति देती है। प्रशासक AWS CLI या Amazon Bedrock कंसोल के इन्फरेंस प्रोफ़ाइल दृश्य के माध्यम से सक्रिय प्रोफ़ाइल की पुष्टि कर सकते हैं।
कोटा, मॉनिटरिंग, और लॉगिंग
GPT-5.6 ऑन‑डिमांड कोटा को प्रति मिनट अनुरोधों और प्रति मिनट टोकन के आधार पर मापा जाता है, जहाँ टोकन बर्नडाउन यह निर्धारित करता है कि प्रत्येक अनुरोध कोटा में कितना टोकन खर्च करता है। AWS के अनुसार, GPT-5.6 के लिए इनपुट टोकन और कैश‑राइट इनपुट टोकन एक‑से‑एक दर से गिने जाते हैं, जबकि प्रत्येक आउटपुट टोकन कोटा से 10 टोकन खर्च करता है। कोटा को Service Quotas कंसोल के माध्यम से स्रोत रीजन में समीक्षा और बढ़ाया जाता है जहाँ एप्लिकेशन चल रहा है, और AWS ने ग्राहकों को वृद्धि का अनुरोध जल्दी करने, उपयोग की निगरानी करने, तथा प्रोडक्शन रोलआउट से पहले प्रतिनिधि प्रॉम्प्ट, स्ट्रीमिंग व्यवहार, समवर्तीता, और पीक ट्रैफ़िक का परीक्षण करने की सलाह दी।
क्योंकि GPT-5.6 अनुरोध Bedrock Runtime API का उपयोग करते हैं, वैश्विक इन्फरेंस प्रोफ़ाइल के माध्यम से किए गए कॉल मॉडल इन्भोकेशन लॉगिंग में अन्य ऑन‑डिमांड अनुरोधों की तरह दिखते हैं, जिनमें रिकॉर्ड में इन्फरेंस प्रोफ़ाइल ID और इन्भोकेशन मेटाडेटा शामिल होते हैं। Codex OpenTelemetry प्रोटोकॉल के माध्यम से मेट्रिक्स निर्यात करता है, और CloudWatch Coding Agent Insights उस टेलीमेट्री के लिए एक डैशबोर्ड प्रदान करता है, जो टोकन उपयोग, API अनुरोध, सक्रिय उपयोगकर्ता, वार्तालाप गतिविधि, और कैश हिट रेट को कवर करता है।
AWS डैशबोर्ड के लिए दो कॉन्फ़िगरेशन पाथ प्रदान करता है: CloudWatch मेट्रिक्स API कुंजी का उपयोग करके एक बियरर‑टोकन दृष्टिकोण, और एक एंटरप्राइज़ रोलआउट जिसमें स्थानीय कलेक्टर डेवलपर की फेडरेटेड क्रेडेंशियल्स का उपयोग करके SigV4 से निर्यात को साइन करता है। AWS मेट्रिक्स API कुंजी को दीर्घकालिक क्रेडेंशियल मानता है और इसे केवल तब सुझाता है जब अल्पकालिक क्रेडेंशियल संभव न हों। एंटरप्राइज़ पाथ उन संगठनों के लिए अनुशंसित विकल्प है जो कॉरपोरेट सिंगल साइन‑ऑन के माध्यम से डेवलपर पहचान को फेडरेट करते हैं, AWS ने कहा।












