Modele și platforme AI
OpenAI reduce prețurile API pentru cele două niveluri mai ieftine GPT-5.6

OpenAI a scăzut prețul API pentru cele două modele GPT-5.6 mai ieftine pe 30 iulie 2026, reducând cel mai ieftin nivel cu 80% și nivelul mediu cu 20%, în timp ce nivelul său de top a rămas neatins. Schimbarea este înregistrată în jurnalul de schimbări al companiei și este deja activă pe lista de prețuri publicată.
Pe milioane de tokeni de intrare și ieșire, tarifele standard sunt acum:
- GPT-5.6 Luna: 20 de cenți și 1,20 dolari, față de 1 dolar și 6 dolari
- GPT-5.6 Terra: 2 dolari și 12 dolari, față de 2,50 dolari și 15 dolari
- GPT-5.6 Sol: 5 dolari și 30 de dolari, fără modificări, ceea ce corespunde ratei sale predecesoare GPT-5.5
Toate cele trei niveluri au atins disponibilitatea generală pe 9 iulie 2026, la prețurile anterioare, ceea ce plasează reevaluarea la trei săptămâni de la viața comercială a familiei.
Reducerea se aplică tuturor nivelurilor de serviciu de pe foaie, nu doar tariful de bază. Procesarea în lot și Flex, ambele la jumătate din prețul standard, plasează acum Luna la 10 cenți pentru intrare și 60 de cenți pentru ieșire. Citirile de intrare în cache, cu discount de 90%, scad la doi cenți pe milioane de tokeni pentru Luna și 20 de cenți pentru Terra. Solicitările cu context lung, care sunt facturate la dublul ratei de intrare și 1,5 ori ieșire, ajung la 40 de cenți și 1,80 dolari pentru Luna. Cumpărătorii care trec prin Amazon Bedrock sunt facturați de AWS, iar OpenAI menționează că aceste rate pot diferi de ale lor.
Nivelurile mai ieftine sunt unde trăiesc traficul de producție de volum ridicat: clasificare, extragere, rutare de solicitări, redactare inițială și buclele lungi de agenți în care o singură instrucțiune a utilizatorului poate declanșa zeci de apeluri de model înainte de a returna un răspuns. O reducere de cinci ori a nivelului care absoarbe acest volum schimbă aritmetica pentru care sarcini sunt valoroase pentru a fi automate.
Unde se situează nivelurile mai ieftine în raport cu Claude
La 20 de cenți pentru intrare și 1,20 dolari pentru ieșire, Luna subminează modelul publicat cel mai ieftin al lui Anthropic, Haiku 4.5, cu un factor de cinci pentru intrare și aproximativ patru pentru ieșire, conform paginii de prețuri Anthropic. Noul tarif al lui Terra se situează sub 3 dolari și 15 dolari pe care Claude Sonnet 5 urmează să îi perceapă odată ce rata introductivă de 2 dolari și 10 dolari expiră pe 31 august 2026. La capătul ambelor game, Sol încă costă mai mult pentru ieșire decât Opus 5, pe care Anthropic îl prețuiește la 5 dolari și 25 de dolari.
Procesarea prioritară devine modul Rapid
În aceeași intrare de jurnal de schimbări, se pensionează Procesarea prioritară și se înlocuiește cu modul Rapid. Pentru Sol, OpenAI spune că modul Rapid rulează până la 2,5 ori viteza standard la dublul prețului, iar schimbarea este compatibilă cu versiunile anterioare: solicitările deja marcate pentru prioritate se routează către modul Rapid fără modificări de cod. Tarifele modului Rapid sunt 10 dolari și 60 de dolari pentru Sol, 4 dolari și 24 de dolari pentru Terra și 40 de cenți și 2,40 dolari pentru Luna.
Anthropic vinde același produs sub același nume și aceleași termene — mod rapid pentru Opus 5, până la 2,5 ori mai rapid la dublul prețului standard. Cele două liste de prețuri converg acum și pe inferența fixată pe regiune. OpenAI percepe o majorare de 10% pentru modelele lansate pe sau după 5 martie 2026, atunci când un client necesită rezidență de date; Anthropic taxează inferența doar în SUA la 1,1 ori rata sa standard.
Ce a făcut nivelurile mai ieftine mai ieftine
OpenAI a publicat contabilitatea sa cu o zi înainte de reducere. Într-un post de inginerie din 29 iulie 2026, cinci membri ai personalului său tehnic au descris optimizări în inferență și în harnașul agentului din spatele Codex și ChatGPT Work. Sol, care rulează în interiorul Codex, a rescris nucleul GPU de producție al companiei; combinat cu munca mai largă de nucleu, OpenAI spune că a redus costurile de servire de la capăt la capăt cu 20%. Sol a redesenat, de asemenea, modelul său de decodificare speculativă pe sute de experimente, ceea ce compania îi atribuie o creștere a eficienței generării de tokeni cu peste 15%.
Acestea sunt cifrele OpenAI pentru propria sa stivă. Postul s-a încheiat cu un angajament de a transmite “îmbunătățirile sub acoperire înapoi către utilizatorii și clienții noștri sub forma unei inteligențe mai disponibile și mai eficiente din punct de vedere al costurilor.” Lista de prețuri a urmat a doua zi.
Lucrul la harnașul agentului indică spre același centru de cost pe care îl vizează și reducerea prețului. OpenAI limitează ieșirea instrumentului la 10.000 de tokeni în mod implicit și păstrează istoricul modelului vizibil doar în modul de adăugare, astfel încât o buclă de agent care retrimite instrucțiunile și definițiile instrumentului la fiecare pas lovește cache-ul de intrare în loc de a plăti tarifele complete de intrare. Pe o sarcină care necesită 30 de solicitări de model, aceasta înseamnă 30 de șanse de a evita recalcularea aceluiași prefix.
Reducerea are loc în timp ce cumpărătorii auditează cheltuielile cu inferența și extind care echipe ating modelele: cercetarea OpenAI a constatat că angajații utilizează ChatGPT dincolo de titlurile lor de job. Organizația de inginerie Amazon a trecut la limitarea cheltuielilor cu IA după depășiri de cost, în aceeași zi, și OpenAI a lansat limite stricte de cheltuieli pentru organizațiile și proiectele API pe 22 iulie 2026, permițând administratorilor să seteze un plafon lunar care începe să returneze erori odată ce cheltuielile urmărite ating limita.
Pentru o echipă care rulează deja sarcini de volum mare către Luna, aceleași apeluri costă acum o cincime din ceea ce costau anterior, cu un plafon pe care îl pot seta în panou. Cu prețul lui Sol neatins, decizia în timp real rămâne acolo unde OpenAI a plasat-o de la lansarea familiei: care nivel necesită fiecare solicitare.












