Modele și platforme AI

OpenAI afirmă că agenții acoperă acum 3,1 zile de lucru pentru fiecare zi de lucru a cercetătorului

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Organizația de cercetare a OpenAI rulează acum 3,1 zile de lucru ale agenților pentru fiecare zi de lucru a forței umane, a declarat compania într-un eseu din 8 septembrie 2026 care explică cum intenționează să transforme capacitatea modelelor de frontieră în venituri. Cifra, măsurată în raport cu o zi de lucru standard de opt ore din mijlocul lui august 2026, susține un argument mai amplu al directorului financiar Sarah Friar, conform căruia modele mai capabile, o bază de utilizatori de peste un miliard de activi săptămânali și o strategie de calcul completă se întăresc reciproc.

Eseul, intitulat „The Work Now Within Reach”, este cel mai recent al lui Friar dintr-o serie despre afacerea și economia calculului la OpenAI. OpenAI a numit-o pe Friar CFO în iunie 2024; anterior a fost CEO la Nextdoor și CFO la Square.

Utilizare și venituri

OpenAI a declarat că produsele sale ajung la peste un miliard de utilizatori activi săptămânal și la 2,5 milioane de întreprinderi, și că fiecare avansare în cercetare îmbunătățește ChatGPT, ChatGPT Work, Codex și aplicațiile construite pe API-ul său. Compania a spus că accesul gratuit susținut prin publicitate ajută oamenii să descopere unde este utilă inteligența artificială, în timp ce abonamentele și ofertele bazate pe utilizare permit clienților să cheltuiască mai mult pe măsură ce găsesc mai multă valoare.

Citat din studiul său privind planurile individuale ChatGPT, OpenAI a declarat că volumul zilnic de mesaje a fost cu aproximativ 50 % mai mare la șase luni după înscriere decât în prima lună, și că utilizatorii au încercat aproximativ de două ori mai multe sarcini distincte. Analiza de bază se bazează pe un eșantion de 0,1 % din conturile create între 15 octombrie 2025 și 1 mai 2026, cu activitatea urmărită până la 31 mai 2026; aceasta măsoară mesajele și diversitatea sarcinilor în raport cu primele 28 de zile ale fiecărui utilizator și clasifică mesajele în 53 de categorii de capacitate.

Eseul evidențiază, de asemenea, cinci implementări ale clienților. Spitalul pentru copii Boston a raportat peste 40 de diagnostice în cazuri de boli rare anterior nerezolvate prin cercetare asistată de IA. Cars24 a declarat că agenții săi gestionează peste un milion de minute de conversație pe lună în procesul de cumpărare și vânzare de mașini. Circles a raportat o rezolvare autonomă de 65 % a interacțiunilor de servicii clienți în fluxurile de lucru suportate, iar Balyasny Asset Management a spus că Analistul său de discursuri ale băncilor centrale a redus analiza scenariilor macroeconomice de la două zile la aproximativ 30 de minute. Replit oferă un Mod Gratuit care permite oamenilor să planifice software fără a consuma limita lor de utilizare. Fiecare cifră provine din contul propriu al clientului, așa cum este prezentat de OpenAI.

Agenți în interiorul organizației de cercetare

Cifra de 3,1 zile de lucru ale agenților provine dintr-o actualizare de cercetare a OpenAI publicată pe 6 septembrie 2026, care a raportat că înainte de iunie 2026 timpul total de rulare al agenților în întreaga organizație de cercetare era încă sub nivelul total al muncii umane. Actualizarea a precizat că cercetătorul median utiliza peste 600 $ pe zi pentru inferență la prețurile API în mijlocul lui august, iar utilizatorul din percentila 90 utiliza peste 7 000 $ în tokenuri pe zi.

Aceeași actualizare a afirmat că ratele de succes ale agenților de programare au crescut din ianuarie până în iulie 2026 în mai multe categorii de dificultate a sarcinilor, menționând totuși că sarcinile mai lungi necesitau în continuare ghidare umană: în ultimele șase luni, peste jumătate din sarcinile de succes estimate la patru‑opt ore de timp uman au implicat cel puțin o intervenție. În eseu, OpenAI a declarat că oamenii încă stabilesc priorități de cercetare și evaluează rezultatele, și că echipele folosesc agenți pentru a rezolva probleme de infrastructură care odinioară necesitau suport specializat.

Capacitatea modelului și costurile de calcul

Eseul lui Friar prezintă GPT-6 Astra ca motorul actual al capacității, descriindu-l ca fiind de ultimă generație în utilizarea calculatorului, navigare, inginerie software, securitate cibernetică, știință și muncă profesională. În postarea de lansare, OpenAI a declarat că Astra obține 98 % la FrontierMath Tier 4, 99,9 % la ARC‑AGI‑3 și 100 % la ExploitBench, și că îndeplinește pragul Critic în securitatea cibernetică conform Cadrelor de Pregătire ale companiei. Acestea sunt rezultatele raportate de OpenAI. Compania a afirmat că Astra a început să fie implementat la un set limitat de organizații pe 3 septembrie 2026, cu disponibilitate generală în toate nivelurile plătite ale ChatGPT, API-ul, Microsoft Azure și AWS Bedrock în zilele următoare.

În ceea ce privește economia servirii, eseul reia două cifre din postarea tehnică a OpenAI din 29 iulie 2026 despre GPT‑5.6: îmbunătățiri ale software‑ului de servire în producție care au redus costurile de servire de la capăt la capăt cu 20 % și lucrări de decodare speculativă care au crescut eficiența generării de tokenuri cu peste 15 %. Ambele progrese au fost obținute cu GPT‑5.6 Sol funcționând în interiorul Codex, inclusiv prin rescrierea autonomă a nucleelor de producție, potrivit postării tehnice.

Eseul recapitulează, de asemenea, primele rezultate pentru Jalapeño, cipul de inferență personalizat al OpenAI, publicat pentru prima dată pe 25 august 2026. În testele InferenceX pe GPT‑OSS 120B, DeepSeek R1 și Kimi K2.5, OpenAI a declarat că cipul a livrat de 1,5‑1,9 ori mai mult debit maxim de tokeni pe watt decât sistemele comerciale testate, utilizând puterea nominală a cipului pentru a normaliza comparația, cu o latență de la capăt la capăt de 1,7‑3,6 ori mai mică. OpenAI a spus că intenționează să înceapă implementarea Jalapeño în infrastructura sa de calcul până la sfârșitul anului, alături de acceleratoare de la NVIDIA, AMD și alți parteneri, și că versiunile de a doua și a treia generație sunt în dezvoltare.

Friar a scris că OpenAI evaluează fiecare investiție în funcție de cererea pe care o poate satisface, de rapiditatea cu care devine productivă și de dacă veniturile justifică capitalul angajat, și că veniturile generate de adoptarea în creștere finanțează cercetarea și infrastructura suplimentare.

Jonas Reeve este un analist generat de IA la Unite.AI, axat pe inteligența artificială cognitivă, inteligența artificială generală (AGI) și fundamentele teoretice ale inteligenței mașinilor. Lucrările sale explorează modul în care învățarea, raționamentul, memoria și abstractizarea emerg în sisteme atât biologice, cât și artificiale, stabilind legături între arhitecturile moderne de IA și întrebările de lungă durată din știința cognitivă și filosofia minții.
Cu o abordare conceptuală și reflexivă, Jonas examinează cadre precum modelele de raționament, sistemele agenților, cogniția emergentă și teoria alinierii, având ca scop clarificarea progresului către AGI și a ceea ce nu reprezintă. Mai degrabă decât a urmări termene limită sau a fi influențat de tendințe, el subliniază principiile de bază, rigurozitatea conceptuală și limitele modelelor actuale.
Articolele scrise de Jonas Reeve sunt generate de IA și revizuite de echipa editorială a Unite.AI pentru a asigura acuratețea, claritatea și discuția responsabilă a conceptelor avansate de IA.