Modely a platformy AI
AWS otevírá přístup k GPT-5.6 na Amazon Bedrock z australských regionů

Amazon Web Services oznámila 2. září 2026, že týmy v Austrálii nyní mohou přistupovat k modelům GPT-5.6 od OpenAI na Amazon Bedrock, vyvolávat varianty Sol, Terra a Luna z regionů Asia Pacific (Sydney) a Asia Pacific (Melbourne) pomocí globálního inferenčního přístupu napříč regiony.
V rámci uspořádání aplikace volá koncový bod Amazon Bedrock Runtime v Sydney nebo Melbourne a Bedrock směruje požadavek do podporovaného komerčního AWS regionu k zpracování. AWS uvedla, že to poskytuje australským zákazníkům přístup k širšímu fondu kapacit, aniž by aplikace musely spravovat směrování do cílového regionu. Tři globální inferenční profily zahrnují modely: global.openai.gpt-5.6-sol, global.openai.gpt-5.6-terra a global.openai.gpt-5.6-luna. Sydney má kód regionu ap-southeast-2 a Melbourne ap-southeast-4.
Tři varianty GPT-5.6
AWS popsal tři varianty jako sloužící různým profilům zátěže. Podle příspěvku na blogu AWS Machine Learning je GPT-5.6 Sol vhodný pro náročné úlohy vyžadující uvažování, programování a agentní zátěže; Terra vyvažuje výkon a náklady pro každodenní produkční použití; a Luna poskytuje rychlé a cenově dostupné inferování pro aplikace s vysokým objemem a citlivé na latenci. Všechny tři přijímají textové i obrazové vstupy, generují text a podporují kontextová okna až do 1 milionu tokenů.
Z obou australských regionů mohou vývojáři vyvolávat modely třemi přístupovými cestami na koncovém bodě Bedrock Runtime: OpenAI Responses API, OpenAI Chat Completions API a Amazon Bedrock Converse API. API kompatibilní s OpenAI jsou volána na cestách /openai/v1 koncového bodu místo přes AWS SDK a koncový bod přijímá buď podepisování AWS Signature Version 4, nebo klíč API pro inferenci modelu Amazon Bedrock.
Ukládání promptů je pro GPT-5.6 dostupné prostřednictvím podporovaných API ve dvou režimech. Implicitní ukládání je ve výchozím nastavení povoleno bez změn kódu, zatímco explicitní ukládání umožňuje vývojářům definovat znovupoužitelný prefix, hranici cache a klíč cache. AWS poznamenala, že členství v profilech a dostupnost modelu se mohou měnit, a odkázala zákazníky na dokumentaci podpory inferencí napříč regiony, aby před nasazením ověřili konfigurace.
Integrace Codex a OIDC autentizace
Kódovací agent Codex od OpenAI může používat stejné globální inferenční profily prostřednictvím poskytovatele modelu Bedrock Runtime zabudovaného v nejnovějším Codex CLI. AWS uvedla, že konfiguraci ověřila pomocí codex-cli 0.149.1 běžícího GPT-5.6 Sol ze Sydney.
Pro organizace, které federují identitu přes Okta, Auth0, Microsoft Entra ID, Amazon Cognito nebo AWS IAM Identity Center, AWS poskytuje ukázkový pomocník pověření, který vymění token OpenID Connect za dočasná AWS pověření. Codex pak tato pověření čte prostřednictvím standardního řetězce pověření AWS a požadavky jsou podepisovány pomocí SigV4, takže v inferenční cestě není zapojen žádný klíč API. Když je profil podpořen IAM Identity Center, pověření jsou již krátkodobá a rotují s relací jednotného přihlášení.
Předpoklady pro australská nasazení zahrnují účet AWS s povoleným zdrojovým regionem Sydney nebo Melbourne, roli nebo uživatele IAM s oprávněním vyvolávat inferenční profily GPT-5.6 a Python 3.9 nebo novější s nainstalovanými balíčky openai, boto3 a aws-bedrock-token-generator. Organizace používající zásady řízení služeb musí ověřit, že jejich zásada povoluje globální inferenční profily GPT-5.6 ve vybraném zdrojovém regionu. Správci mohou potvrdit aktivní profily pomocí AWS CLI nebo zobrazení inferenčních profilů v konzoli Amazon Bedrock.
Kvóty, monitorování a protokolování
Kvóty na vyžádání pro GPT-5.6 se měří v požadavcích za minutu a tokenech za minutu, přičemž spotřeba tokenů určuje, jak každý požadavek čerpá tokenovou kvótu. Pro GPT-5.6 se vstupní tokeny a tokeny zapisované do cache počítají v poměru 1:1, zatímco každý výstupní token spotřebuje 10 tokenů z kvóty, uvádí AWS. Kvóty jsou přezkoumávány a zvyšovány prostřednictvím konzole Service Quotas ve zdrojovém regionu, který aplikace používá, a AWS doporučila zákazníkům požádat o zvýšení včas, sledovat využití a testovat reprezentativní promptové vstupy, streamingové chování, souběžnost a špičkový provoz před nasazením do výroby.
Protože požadavky GPT-5.6 používají Bedrock Runtime API, volání provedená přes globální inferenční profily se objevují v protokolování volání modelu stejně jako ostatní požadavky na vyžádání, přičemž záznamy obsahují ID inferenčního profilu a metadata volání. Codex exportuje metriky přes protokol OpenTelemetry a CloudWatch Coding Agent Insights poskytuje řídicí panel pro tuto telemetrii, zahrnující využití tokenů, požadavky API, aktivní uživatele, aktivitu konverzací a míru zásahů do cache.
AWS nabízí dvě konfigurační cesty pro řídicí panel: přístup pomocí tokenu nosiče s využitím klíče API pro metriky CloudWatch a podnikové nasazení, při kterém místní sběrač podepisuje export pomocí SigV4 s federovanými pověřeními vývojáře. AWS klasifikuje klíč API pro metriky jako dlouhodobé pověření a doporučuje jej jen tam, kde nejsou možné krátkodobé pověření. Podniková cesta je podle AWS doporučenou možností pro organizace, které federují identitu vývojářů prostřednictvím firemního jednotného přihlášení.












