AI-mallit ja alustat

OpenAI:n 200 dollarin ChatGPT Pro: AI, joka ajattelee kovemmin (mutta tarvitsetko sitä?)

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

OpenAI on juuri julkaisi mitä he kutsuvat “maailman älykkäimmäksi malliksi”. Se tulee 200 dollarin kuukausimaksulla ja lupailee ajatella kovemmin, työskennellä kauemmin ja ratkaista monimutkaisempia ongelmia kuin mitä olemme aiemmin nähneet. Mutta maailmassa, jossa AI-ilmoitukset näyttävät putoavan joka viikko, tämä ansaitsee tarkemman katseenvetokäytännön.

Uusi ChatGPT Pro, joka perustuu o1-malliin, ei ole vain tavallinen päivitys. Vaikka tavallinen ChatGPT on tullut kuin Sveitsin armeijan veitsi AI-työkaluista, tämä uusi tarjous on enemmän kuin erikoistuneiden kirurgisten välineiden kaltaista – uskomattoman voimakasta, mutta ei kaikille.

Mitä o1 todella tarjoaa?

Leikataan suoraan aiheeseen ja katsotaan, mitä tekee o1:sta erilaisen. Malli näyttää vaikuttavia lukuja, mutta mitä todella merkitsee, on se, missä nämä parannukset tekevät todellista eroa.

Todellisissa testeissä o1 näyttää parannuksia kolmessa avainalueessa:

  1. Syvä tekninen ongelmanratkaisu: Malli saavuttaa 50%:n tarkkuuden AIME 2024 matematiikan kilpailuissa – ylös 37%:sta edellisistä versioista. Mutta vielä tärkeämpää on, että se ylläpitää tätä suorituskykyä johdonmukaisesti. Kun testattu luotettavuudesta (saada oikea vastaus 4 kertaa 4:stä), o1 Pro -tila ylittää edeltäjiään merkittävästi.
  2. Tieteellinen päättely: Tohtorin tutkintotason tieteellisissä kysymyksissä o1 osoittaa 74%:n onnistumisprosentin, ja vielä vaikuttavampia parannuksia johdonmukaisuudessa. Mitä on mielenkiintoista, on se, miten tämä kääntyy todellisiin tutkimussovelluksiin – näemme tutkijoita käyttävän sitä monimutkaisten biologisten kokeiden suunnittelussa.
  3. Ohjelmointi ja tekninen analyysi: Ehkä eniten kertoo o1:sta se, että se saavuttaa 62%:n läpäisyprosentin edistyneissä ohjelmointihaikeissa, osoittaen erityistä vahvuuksia monimutkaisissa, usean askeleen ongelmanratkaisussa. Mutta – ja tämä on ratkaisevaa – se todella kamppailee yksinkertaisempien, iteratiivisten tehtävien kanssa, jotka vaativat edestakaisin keskustelua.

Kuva: OpenAI

Todellinen innovaatio tässä ei ole pelkästään raaka suorituskyky – se on luotettavuus. Kun malli tarvitsee ajatella kovemmin ongelman parissa, se todella tekee niin, käyttäen enemmän aikaa vastaustensa prosessointiin ja validointiin.

Mutta on yksi asia, joka pitää mielessä: kaikki tämä “ajattelu” tulee kompromisseja. Malli on merkittävästi hitaampi, joskus vaatiessaan paljon enemmän aikaa vastaustensa luomiseen. Ja monille päivittäisille tehtäville tämä lisä “hevosvoima” ei ole vain tarpeetonta – se saattaa jopa olla vastoin tuottavuutta.

Mitä tapahtuu, kun AI:lle annetaan näin paljon laskentatehoa?

Puhutaan siitä, mitä tapahtuu, kun AI:lle annetaan enemmän laskentatehoa. Unohda markkinointipuhe – se, mitä näemme o1:ssa, on mielenkiintoista, koska se muuttaa kokonaan sitä, miten ajattelemme AI-apua.

Ajattele sitä kuin eroa nopeasta keskustelusta kollegan kanssa ja syvemmän strategiatyöskentelyn välillä. Standardit AI-mallit ovat hyviä nopeisiin keskusteluihin – ne ovat nopeita, avuliaita ja saavat tehtävän done. Mutta o1? Se on kuin senioriasiantuntija, joka ottaa aikaa, ajattelee asioita läpi ja joskus tulee takaisin näkemyksillä, joita et olisi edes käsittänyt.

Mitä on todella vallankumouksellista tässä lähestymistavassa?

  1. Syvempi “ajattelu”: Kun annat AI-mallille enemmän aikaa “ajatella”, se ei ajattele vain pidempään – se ajattelee eri tavoin. Se tutkii useita näkökulmia ja ottaa huomioon reunatapaukset. Tämä on syynä, miksi tutkijat löytävät siitä erityisen arvokasta kokeiden suunnittelussa ja hypoteesien luomisessa.
  2. Luotettavuus: Tässä on jokin, mistä kukaan ei puhu: johdonmukaisuus saattaa olla o1:n todellinen supervoima. Kun muut mallit saattavat osua monimutkaiseen ongelmaan kerran ja epäonnistua seuraavat kolme kertaa, o1 osoittaa merkittävää johdonmukaisuutta korkean tason päättelyssä. Ammattilaisten, jotka työskentelevät kriittisissä ongelmissa, tämä luotettavuus on suuri juttu.

Älykkään ostajan opas AI-tehojen käyttöön

Pitäisi olla rehellinen keskustelu siitä 200 dollarin hinnasta. Onko se todella arvokasta? No, se riippuu täysin siitä, miten ajattelet AI-apua työskentelyssäsi.

Mielenkiintoista on, että ne, jotka hyötyvät eniten o1:stä, eivät välttämättä ole niitä, jotka työskentelevät monimutkaisimmissa ongelmissa – he ovat ne, jotka työskentelevät ongelmien parissa, joissa ollaan väärässä on erittäin kallista. Ellei sinulla ole tiettyjä tilanteita, joissa tämä lisäteho on välttämätöntä, se saattaa vain hidastaa sinua.

Käyttääksesi o1:stä tehokkaasti, tarvitset perustavanlaatuista muutosta siinä, miten lähestyt AI-viestintää:

  1. Syvyys yli nopeuden
  • Sen sijaan, että ajattelet nopeita edestakaisin keskusteluita, ajattele sitä kuin tarkoitushakuisia tutkimuspyyntöjä
  • Suunnittele pidemmille vastausajoille, mutta odota kattavampaa analyysiä
  1. Laatu yli määrän
  • Keskity monimutkaisiin, arvokkaisiin ongelmiihin
  • Käytä standardimalleja rutiinitehtäviin
  1. Strateginen käyttö
  • Yhdistä o1 muihin AI-työkaluihin optimaalisen työskentelyprosessin luomiseksi
  • Säästä raskasta laskentatehoa siihen, missä se on eniten tarpeen

o1 ei yritä olla kaikille kaikkea. Sen sijaan se pyrkii saamaan meidät ajattelemaan strategisesti AI-työkalujen käytöstä. Ehkä todellinen innovaatio tässä ei ole vain teknologia, vaan se, miten se saa meidät muuttamaan lähestymistapaamme AI-apuun.

Ajattele AI-työkaluasi kuin ammattikeittiötä. Kyllä, voit käyttää teollisuusluokan laitteita kaikkeen, mutta mestarikokit tietävät tarkalleen, milloin käyttää hienoa sous vide -konetta ja milloin yksinkertainen paistinpannu tekee työn paremmin.

Ennen kuin hyppäät tuohon 200 dollarin tilausmalliin, kokeile tätä: Pidä lokia AI-viestintäsi viikon ajan. Merkitse, mitkä niistä todella vaativat syvempää ajattelua verrattuna nopeisiin vastauksiin. Tämä kertoo sinulle enemmän siitä, tarvitsetko o1:stä kuin mikään benchmark koskaan voisi.

Se, mikä minua eniten innoittaa o1:sta, ei ole se, mitä se voi tehdä tänään, vaan se, mitä se kertoo huomisesta. Seuraamme AI:n kehittymistä, joka muuttaa työkalua, joka yrittää tehdä kaiken, työkaluksi, joka tietää tarkalleen, mihin se on parhaimmillaan.

Riippumatta siitä, hyppäätkö o1-junaan tai ei, yksi asia on varma: tapa, jolla ajattelemme ja käytämme AI:ta, kehittyy, ja se on jotain, mistä on syytä pitää huolta.

Alex johtaa Unite.AI:n tekoälypohjaista uutistoimintaa, yhdistäen journalismia, tutkimusta ja automaatiota tukeakseen ajantasaista ja skaalautuvaa tekoälyn kattavuutta. Hänen työnsä auttaa varmistamaan, että nousevat tekoälykehitykset saadaan esiin tehokkaasti samalla kun julkaisun toimitukselliset standardit säilyvät.