AI-mallit ja alustat

Maailmanlaajuinen katko iski OpenAI:n ChatGPT:hen, API:hin ja Codexiin

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

OpenAI:n ydinpalvelut romahtivat maailmanlaajuisesti 25. heinäkuuta 2026 aamulla, ja yhtiön omat tilasivut tunnustivat korkeat virheiden määrät ChatGPT:ssä, kehittäjien API:ssa ja Codex-koodausavustajassa. Käyttäjät Yhdysvalloista Intiaan ja Australiaan asti ilmoittivat, etteivät he voineet ladata keskusteluja, tavoittaa tallennettua keskusteluhistoriaa tai suorittaa ohjelmia, mukaan lukien tuhannet ulkopuoliset sovellukset, jotka riippuvat näistä päätepisteistä.

Omalla tilasivullaan OpenAI ilmoitti vain, että se “tutkii ongelmaa luetelluille palveluille”, mainiten API:t, ChatGPT:n ja Codexin vaikuttuneiksi. Noin kello 5:30 ET yhtiö ei ollut tunnistanut syytä eikä tarjonnut arviota täydellisestä palautumisesta. Sen yleinen tila-osoitin heilahti tapahtuman aikana, ja joissain kohdissa se näytti järjestelmien olevan täysin toiminnassa, vaikka itse tapahtuma oli edelleen avoinna – tällainen ristiriita, joka usein ilmenee, kun jaettu riippuvuus, ei yksittäinen tuote, on se, joka epäonnistuu.

Häiriön laajuus

Käyttäjien antamat tiedot osoittivat laajan, lähes samanaikaisen epäonnistumisen sijaan alueellisen viiveen. Häiriöseuranta DownDetector rekisteröi ilmoitusten nousun noin kello 5:11 ET, keskittyen Yhdysvaltoihin, Eurooppaan, Intiaan, Japaniin ja Australiaan. ChatGPT sai suurimman osan valituksia, seurattuna OpenAI:n mobiilisovelluksella ja Codexilla, jakauma, joka on yhdenmukainen taustajärjestelmän ongelman kanssa, joka sijaitsee yksittäisten etupintojen yläpuolella. Ilmoitukset kuvasivat tuttuja merkkejä palvelun epäonnistumisesta: ohjelmat, jotka jäävät roikkumaan ilman vastausta, keskustelut ja projektit, jotka eivät lataudu, ja kirjautumissessiot, jotka päätyvät.

Tämä jakauma on tärkeämpää kuin ilmoitusten määrä. Kun virhe ilmenee kerran verkkosovelluksessa, mobiililiittymässä ja API:ssa, syy on yleensä jaettu kerroksessa (tunnistus, reititys tai palveluinfrastruktuuri, jota jokainen tuote kutsuu), eikä yhdessä palvelussa. OpenAI ei ole sanonut, mikä se on, eikä mitään sen julkisissa päivityksissä viittaa syyhyn.

Miksi API-katko iskee kovimmin

OpenAI:n liiketoiminnan kannalta kuluttaja-chatbotti, joka pimenee, on näkyvä oire; API:n ja Codexin samanaikainen sammuminen on kalliimpi osa. OpenAI on yksi laajimmin käytetyistä tekoälyalustoista, ja suurin osa tästä käytöstä on nyt ohjelmallista eikä henkilön kirjoittamaa chat-ruutuun. API on tuote, jolle suuri joukko start-upeja ja yrityksiä rakentaa, kytkien OpenAI:n malleja omiin ohjelmiinsa, agenteihinsa ja sisäisiin työkaluihinsa; Codex on osa kehittäjien koodausprosesseja. Kun nämä päätepisteet lopettavat toimintansa, epäonnistuminen leviää alaspäin: asiakaspalvelun ominaisuudet, jotka kutsuvat malleja, palauttavat virheitä, ja insinööritöitä, jotka nojaavat näihin työkaluihin, jäävät odottamaan palvelun palautumista. Tiimille, jotka myyvät ohjelmia, jotka perustuvat näihin kutsuihin, OpenAI:n katko muuttuu heidän oman katkokseen, joka ilmenee heidän asiakkaidensa kanssa rikkoontuneina ominaisuuksina ja puuttuvina palvelutasotavoitteina.

Tämä altistus on hiljainen kustannus alan konsolidaatiosta muutamaksi inference-toimittajaksi. Miljardit virtaavat laskentaan, joka kouluttaa ja palvelee näitä malleja, AMD:n 5 miljardin dollarin panostuksesta Anthropiciin voimalaitosten uusien datakeskusten voimakauppoihin, mutta jo käytössä olevan kapasiteetin luotettavuus päättää, onko kapasiteetti käytettävissä tietyllä aamulla. Malli, johon asiakas ei voi päästä, on arvoton kyseisellä ajanjaksolla.

Toistuva heilahtelu

Keskeytys sattuu epätasaisen käytettävyyden jaksoon. OpenAI:n tilahistoria merkitsee useita korkean virheen määrän tapahtumia ChatGPT:ssä, API:ssa ja Codexissa edeltävien päivien aikana, joista useat vaativat lieventämistoimia ennen palautumista. Yhtiön oma tilanäkymä ilmoittaa ChatGPT:n käytettävyyden noin 99,7 prosentiksi viimeisten kolmen kuukauden aikana, mikä on vähemmän kuin noin 99,9 prosenttia, jonka se ilmoittaa API:lle, osoittaen, että kuluttajapinta on edelleen epävakain.

Taajuus on todellinen tarina yrityksille, jotka reitittävät nyt tuotantoliikenteen näiden järjestelmien kautta. Yksittäinen katko on melua; katkojen ryhmä alkaa muotoilla arkkitehtuuriin liittyviä päätöksiä, kuten useiden toimittajien fallbackeja, itse isännöityjä malleja työkuormille, jotka eivät voi sietää aamua poissa. Jokainen tapahtuma on yksi datakohta tässä laskelmassa. OpenAI:n hiljattainen ilmoitus, että sen omat testimalleit tulivat Hugging Facen turvallisuustestauksen aikana, oli jo asettanut infrastruktuuri- ja turvallisuustiimit valmiustilaan; näkyvä käytettävyyden kompastus lisää toiminnallisen linjan tähän tarkasteluun.

OpenAI:n insinöörit työskentelevät edelleen tapahtuman parissa, ilman ilmoitettua syytä tai aikataulua palautumiselle. Se, julkaaako yhtiö tapahtuman jälkeen kirjoituksen, kuten se on tehnyt suurempien epäonnistumisten jälkeen, päättää, kuinka paljon loput markkinat oppivat siitä, mikä vei päätepisteet pois.

Theo Nash on AI‑luotu asiantuntija Unite.AI:ssa, joka kattaa AI‑infrastruktuurin, laskennan ja laitteistojärjestelmät, jotka mahdollistavat modernin tekoälyn. Hänen työnsä keskittyy suurten AI‑työkuormien teknisiin perusteisiin, mukaan lukien datakeskukset, kiihdyttimet, verkottuminen ja ohjelmistopino, jotka yhdistävät ne yhteen.

Analyyttisesta ja tekniikkavetoisesta näkökulmasta Theo tarkastelee, miten GPU:iden, räätälöidyn piisirun, muistirakenteiden ja hajautettujen järjestelmien edistysaskeleet mahdollistavat uudet AI‑mallien sukupolvet. Hän kiinnittää erityistä huomiota suorituskyvyn kompromisseihin, energiatehokkuuteen, skaalautuvuuteen ja käytännön rajoitteisiin, jotka muovaavat AI‑infrastruktuurin todellista käyttöönottoa.

Theo Nashin kirjoittamat artikkelit ovat AI‑luotuja ja Unite.AI:n toimituskunta tarkistaa ne varmistaakseen teknisen tarkkuuden, selkeyden ja vastuullisen kattavuuden nopeasti kehittyvässä AI‑laskentaympäristössä.