AI-mallit ja alustat
Mitä sinun täytyy tietää OpenAI:n Operaatiorista

Viime viikkojen aikana OpenAI on luonut pohjaa tuleville kehityksille. Kun useimmat käyttäjät alkoivat tutkia ChatGPT-tehtäviä – uutta ominaisuutta, joka mahdollistaa tehtävien aikatauluttamisen ja käynnistämisen – yhtiö valmisteli jotain paljon merkittävämpää.
Eilisen Operatorin julkaisu on yksi selkeä merkki siitä, mihin suuntaan tekoäly kehittyy: mallit, jotka vain prosessoi tietoa, muuttuvat agenteiksi, jotka voivat toimia rinnakkain ihmisten kanssa.
Jokaisena päivänä vietämme lukemattomia tunteja navigoiden verkkosivuilla, täyttäen lomakkeita, varaten palveluita ja hallitsemalla digitaalisia tehtäviä. Tekoäly on pääasiassa seissyt sivussa, rajoittuen antamaan neuvoja tai prosessoimaan tekstiä. Operator, yhdessä muiden vastaavien ilmoitusten kanssa, kuten Anthropicin Computer Use ja Googleen Project Mariner, muuttaa tämän dynamiikan täysin.
Tekninen saavutus on merkittävä. OpenAI on luonut tekoälyjärjestelmän, joka voi nähdä ja vuorovaikuttaa verkkorajapintojen kanssa ihmisen tavoin. Se ottaa näytönkaappauksia, ymmärtää visuaalista sommitelmaa ja tekee päätöksiä siitä, mihin klikata, mitä kirjoittaa ja miten navigoida.
Tässä on mitä sinun täytyy tietää Operator-agentista: Kun useimmat tekoälytyökalut ovat periaatteessa loukussa API:en ja erityisten integraatioiden takana, Operator toimii verkon kanssa juuri samalla tavalla kuin sinä. Se näkee näytön, ymmärtää kontekstin ja toimii suoraan.
Lähempi katse Operatorin todelliseen suorituskykyyn
Kun tekoälyyritykset julkaisevat suorituskykytestejä, on tärkeää tarkastella huolellisesti, mitä numerot todella tarkoittavat. Operatorin suorituskyky kertoo erilaisen tarinan eri testiympäristöissä.
Vaikuttavin mittari on Operatorin 87%:n onnistumisprosentti WebVoyager-benchmarkissa. Tämä on merkittävää, koska WebVoyager testaa todellisia verkkosivuja – niitä alustoja, joita käytämme päivittäin, kuten Amazon (AMZN ) ja Google Maps. Tämä ei ole kontrolloitu laboratoriotesti, vaan suorituskyky luonnonvaraisten olosuhteiden keskellä.
Mutta kun tarkastelemme muita mittareita, näemme monitahoisemman kuvan:
- WebArena-benchmark: 58.1%:n onnistumisprosentti. Testaa simuloituja verkkosivuja tehtävien, kuten ostosten ja sisällön hallinnan, osalta. Alempi suorituskyky paljastaa jotain tärkeää siitä, miten tekoälyagentit käsittelevät rakennettuja ja rakenteettomia ympäristöjä.
- OSWorld-benchmark: 38.1%:n onnistumisprosentti. Tämä testaa monimutkaisia, usean vaiheen tehtäviä, kuten PDF-tiedostojen yhdistämistä sähköposteista. Merkittävä lasku suorituskyvyssä osoittaa meille tekoälyagenttien nykyiset rajat, kun tehtävät vaativat useita kontekstivaihtoehtoja.
Mikä minua kiinnostaa näistä luvuista, on se, miten ne heijastelevat ihmisen oppimismalleja. Yleensä suoritamme paremmin tutuissa, todellisissa ympäristöissä kuin keinotekoisissa testitilanteissa. Se, että Operator menestyy todellisilla verkkosivuilla, mutta kamppailee simuloitujen kanssa, osoittaa, että sen koulutus priorisoi käytännön hyödyllisyyden teoreettisen suorituskyvyn sijaan.
Nämä mittarit asettavat uudet ennätykset selainautomatisoinnissa, mutta vaihtelevat onnistumisprosentit eri testeissä kertovat meille jotain olennaista OpenAI:n strategiasta.
Ajattele omaa verkkoselaamistasi. Useimmat tehtävät ovat suoraviivaisia: lomakkeiden täyttäminen, ostosten tekeminen, aikataulujen varaaminen. Tässä Operatorin 87%:n onnistumisprosentti loistaa. Monimutkaisemmat tehtävät – joissa suorituskyky laskee – ovat yleensä sellaisia, joissa ihmisen valvonta on arvokasta joka tapauksessa.
Nämä tiedot osoittavat, että OpenAI tekee tietoisen valinnan: täydellistää yleisiä tehtäviä ensin ja laajentaa sitten hitaasti monimutkaisempiin toimiin. Se on käytännöllinen lähestymistapa, joka priorisoi välittömän hyödyllisyyden teoreettisten kykyjen sijaan.

AI-agenttien suorituskyky (OpenAI)
OpenAI:n strategia Operatorin takana
OpenAI:n lähestymistapa Operatorin kanssa paljastaa huolellisesti suunnitellun strategian.
Ensinnäkin, tarkastele aikataulua. Viimeaikaiset uusien ominaisuuksien julkaisut, kuten ChatGPT-tehtävien, eivät olleet vain uusien ominaisuuksien lisäämistä – ne valmistelivat käyttäjiä itsenäisille agenteille.
Mutta tässä on se, mikä on todella mielenkiintoista: OpenAI aikoo paljastaa CUA-mallin API:n kautta. Tämä tarkoittaa, että kehittäjät voivat luoda omat tietokoneen käyttävät agentit.
Vaikutukset tähän ovat merkittäviä:
- Integraatiopotentiaali
- Suora integrointi olemassa oleviin työprosesseihin
- Mukautettuja agenteja erityisille liiketoimintatarpeille
- Toimialakohtaisia automaatio-ratkaisuja
- Tulevan kehityksen polku
- Laajentuminen Plus-, Team- ja Enterprise-käyttäjille
- Suora ChatGPT-integraatio
- Maantieteellinen laajentuminen (vaikka Eurooppaan kestää kauemmin johtuen sääntelyvaatimuksista)
Strategiset kumppanuudet ovat myös paljastavia. OpenAI yrittää luoda koko ekosysteemin. He työskentelevät yritysten, kuten DoorDashin, Instacartin ja OpenTable, kanssa, mutta myös julkisen sektorin organisaatioiden, kuten Stocktonin kaupungin, kanssa.
Tämä osoittaa tulevaisuutta, jossa tekoälyagentit eivät ole vain avustajia, vaan olennainen osa siitä, miten vuorovaikutamme digitaalisten järjestelmien kanssa.
Mitä tämä todella tarkoittaa sinulle
Aloimme vaiheen, jossa tekoäly ei vain vastaa kysymyksiin – se tulee olemaan aktiivinen osanottaja digitaalisessa elämässämme.
Ajattele päivittäisiä verkkotehtäviäsi. Ei niitä monimutkaisia, strategisia töitä, jotka vaativat asiantuntemuksesi, vaan toistuvia tehtäviä. Puhun matkailuvaihtoehtojen tutkimisesta useilla sivustoilla, standardilomakkeiden täyttämisestä, tietojen keräämisestä eri verkkolähteistä ja rutiininomaisen varauksen hallinnasta. Tässä Operator poistaa aluksi digitaalisen byrokratian. Mutta tämä ei ole se, mihin se pysähtyy. Ajan myötä tekoälyagentit pystyvät suorittamaan yhä monimutkaisempia työprosesseja.
Varhaiset suorituskykydatat kertovat myös meille jotain olennaista: Operator menestyy rutiininomaisissa verkkotehtävissä 87%:n onnistumisprosentilla. Varhaiset käyttäjät, jotka oppivat integroimaan sen tehokkaasti, saavat merkittävän tuottavuus-etun.
Integraatiotaikataulu paljastaa OpenAI:n huolellisen lähestymistavan. He aloittavat Pro-käyttäjillä Yhdysvalloissa, laajentavat sitten Plus-, Team- ja Enterprise-käyttäjille, ennen kuin lopulta integroivat suoraan ChatGPT:hen.
Seuraamme perustavanlaatuista muutosta siinä, miten tekoälytyökalut toimivat. Todellinen kysymys, jonka sinun tulisi itseltäsi kysyä, ei ole se, pitäisikö sopeutua tähän muutokseen, vaan miten tehdä se strategisesti. Teknologia kehittyy, mutta periaate pysyy: tekoäly siirtyy vastaamisesta kysymyksiin toimintaan. Ne, jotka ymmärtävät tämän muutoksen aikaisin, saavat merkittävän edun siinä, miten nämä työkalut integroidaan työprosesseihin.












