AI-mallit ja alustat

Cerebras Esittää Maailman Nopeimman AI Inferenssiratkaisun: 20-kertainen Nopeus Murto-OSaan Kustannuksista

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Cerebras Systems (CBRS ), korkean suorituskyvyn AI-laskennan edelläkävijä, on esittänyt uraauurtavan ratkaisun, joka on valmis vallankumouksellistamaan AI-inferenssin. 27. elokuuta 2024 yritys ilmoitti Cerebras Inferenssin julkaisemisesta, joka on maailman nopein AI-inferensspalvelu. Perinteisten GPU-pohjaisien järjestelmien suorituskyvyn jättäen varjoonsa, Cerebras Inferenss toimittaa 20-kertaisen nopeuden murto-osaan kustannuksista, asettaen uuden standardin AI-laskennassa.

Ennennäkemätön Nopeus ja Kustannustehokkuus

Cerebras Inferenss on suunniteltu toimittamaan poikkeuksellista suorituskykyä eri AI-malleille, erityisesti nopeasti kehittyvässä suurten kielen mallien (LLM) segmentissä. Esimerkiksi se prosessoi 1 800 merkkiä sekunnissa Llama 3.1 8B-mallille ja 450 merkkiä sekunnissa Llama 3.1 70B-mallille. Tämä suorituskyky on nicht vain 20-kertainen verrattuna NVIDIA GPU-pohjaisiin ratkaisuihin, vaan se on myös huomattavasti edullisempi. Cerebras tarjoaa tämän palvelun alkaen vain 10 sentistä miljoonaa merkkiä kohden Llama 3.1 8B-mallille ja 60 senttiä miljoonaa merkkiä kohden Llama 3.1 70B-mallille, edustaaen 100-kertaista parannusta hinta-suorituskyvyssä verrattuna olemassa oleviin GPU-pohjaisiin tarjouksiin.

Ylläpitäminen Tarkkuutta Nopeuden Rajalla

Yksi Cerebras Inferenssin vaikuttavimmista puolista on sen kyky ylläpitää huipputasoa olevaa tarkkuutta samalla, kun se toimittaa vertaansa vailla olevaa nopeutta. Toisin kuin muut lähestymistavat, jotka uhraavat tarkkuuden nopeuden vuoksi, Cerebras-ratkaisu pysyy 16-bittisen alueen sisällä koko inferenssiajon ajan. Tämä varmistaa, että suorituskyvyn parannukset eivät tule aiheuttamatta kompromisseja AI-mallien tulosten laadusta, mikä on tärkeä tekijä kehittäjille, jotka keskittyvät tarkkuuteen.

Micah Hill-Smith, Artificial Analyysin perustaja ja toimitusjohtaja, korosti tämän saavutuksen merkitystä: “Cerebras toimittaa nopeuksia, jotka ovat kertaluokkaa nopeampia kuin GPU-pohjaiset ratkaisut Meta Llama 3.1 8B- ja 70B AI-malleille. Mitatamme nopeuksia yli 1 800 tulostusmerkkiä sekunnissa Llama 3.1 8B:lle ja yli 446 tulostusmerkkiä sekunnissa Llama 3.1 70B:lle – uusi ennätys näissä benchmarkkeissa.

AI-inferenssin Kasvava Merkitys

AI-inferenssi on nopeimmin kasvava AI-laskennan segmentti, joka kattaa noin 40 % koko AI-laitteiden markkinaa. Korkean nopeuden AI-inferenssin, kuten Cerebras tarjoaa, on samanlainen kuin laajakaistaisen internetin käyttöönotto – se avaa uusia mahdollisuuksia ja merkitsee uuden aikakauden alkamista AI-sovelluksille. Cerebras Inferenssin avulla kehittäjät voivat nyt luoda seuraavan sukupolven AI-sovelluksia, jotka vaativat monimutkaisia, reaaliaikaisia suorituskykyjä, kuten AI-välikäsittelyjä ja älykkäitä järjestelmiä.

Andrew Ng, DeepLearning.AI:n perustaja, korosti nopeuden merkitystä AI-kehityksessä: “DeepLearning.AI:lla on useita agenteja, jotka vaativat toistuvasti LLM-promptin saadakseen tuloksen. Cerebras on rakentanut vaikuttavan nopean inferenssikyvyn, joka on hyvin hyödyllinen tällaisille työkuormille.

Laaja Teollinen Tuki ja Strategiset Kumppanuudet

Cerebras on saanut vahvan tuen teollisuuden johtajilta ja on muodostanut strategisia kumppanuuksia AI-sovellusten kehittämisen nopeuttamiseksi. Kim Branson, GlaxoSmithKlinen AI/ML:n varapuheenjohtaja, korosti tämän teknologian muuntavan potentiaalia: “Nopeus ja skaala muuttavat kaiken.”

Muita yrityksiä, kuten LiveKit, Perplexity ja Meter, ovat myös ilmaisseet innostuksensa Cerebras Inferenssin vaikutuksesta heidän toimintaansa. Nämä yritykset hyödyntävät Cerebrasin laskentakapasiteetin voimaa luodakseen vastaanottavampia, ihmismäisempiä AI-kokemuksia, parantamaan käyttäjien vuorovaikutusta hakukoneissa ja tehostamaan verkkohallintajärjestelmiä.

Cerebras Inferenssi: Tasoja ja Saavutettavuutta

Cerebras Inferenssi on saatavilla kolmella kilpailukykyisellä tasolla: Ilmainen, Kehittäjä ja Yritys. Ilmainen taso tarjoaa ilmaisen API-pääsyn antaen jaloustasoa laajalle käyttäjäryhmälle. Kehittäjän taso tarjoaa joustavan, serverittömän käyttömahdollisuuden, Llama 3.1 -malleilla hinnoiteltuna 10 senttiä ja 60 senttiä miljoonaa merkkiä kohden. Yritystaso on suunniteltu yrityksille, joilla on jatkuvia työkuormia, tarjoten räätälöityjä malleja, mukautettuja palvelutaso-sopimuksia ja omistajien tukipalveluja, hinnoittelun saatavilla pyynnöstä.

Cerebras Inferenssin Voimanlähde: Wafer Scale Engine 3 (WSE-3)

Cerebras Inferenssin ydin on Cerebras CS-3 -järjestelmä, jota ajaa teollisuuden johtava Wafer Scale Engine 3 (WSE-3). Tämä AI-prosessori on vertaansa vailla sekä koossa että nopeudessa, tarjoten 7 000-kertaisen muistin kaistanleveyden verrattuna NVIDIA H100:aan. WSE-3:n massiivinen skaala mahdollistaa useiden rinnakkaiskäyttäjien käsittelyn, varmistaen tulennopean nopeuden ilman suorituskyvyn heikentymistä. Tämä arkkitehtuuri mahdollistaa Cerebrasille kiertää kompromissit, jotka yleensä vaivaavat GPU-pohjaisia järjestelmiä, tarjoten parhaimman suorituskyvyn AI-työkuormille.

Helmivapaat Integraatiot ja Kehittäjäystävällinen API

Cerebras Inferenssi on suunniteltu kehittäjien tarpeisiin. Se sisältää API:n, joka on täysin yhteensopiva OpenAI Chat Completions API:n kanssa, mahdollistaen helpon siirtymisen vähäisillä koodimuutoksilla. Tämä kehittäjäystävällinen lähestymistapa varmistaa, että Cerebras Inferenssin integroiminen olemassa oleviin työvirtoihin on mahdollisimman vaivatonta, mahdollistaen nopean käyttöönoton korkean suorituskyvyn AI-sovelluksille.

Cerebras Systems: Ajamassa Innovointia Yli Teollisuusrajojen

Cerebras Systems ei ole vain johtava AI-laskennan toimija, vaan myös avainpelaaja useilla aloilla, kuten terveydenhuollossa, energiassa, hallinnossa, tieteellisessä laskennassa ja rahoituspalveluissa. Yrityksen ratkaisut ovat olleet merkittäviä läpimurtojen saavuttamisessa instituutioissa, kuten Kansallisissa Laboratorioissa, Aleph Alphassa, Mayo Clinicissa ja GlaxoSmithKlinessä.

Toimittamalla ennennäkemättömän nopeuden, skaalan ja tarkkuuden, Cerebras mahdollistaa organisaatioille näillä aloilla ratkaista haasteellisia ongelmia AI:ssa ja sen ulkopuolella. Olipa kyse sitten lääkekehityksen nopeuttamisesta terveydenhuollossa tai laskentakapasiteetin parantamisesta tieteellisessä tutkimuksessa, Cerebras on innovaatioiden edelläkävijä.

Johtopäätös: Uusi Aikakausi AI-inferenssille

Cerebras Systems asettaa uuden standardin AI-inferenssille Cerebras Inferenssin julkaisemisella. Tarjoamalla 20-kertaisen nopeuden perinteisiin GPU-pohjaisiin järjestelmiin verrattuna murto-osaan kustannuksista, Cerebras ei ainoastaan tee AI:sta helpommin saatavilla, vaan myös valmistelee tietä seuraavan sukupolven AI-sovelluksille. Sen uraauurtavalla teknologialla, strategisilla kumppanuuksilla ja sitoutumisella innovointiin, Cerebras on valmis johtamaan AI-teollisuutta uudelle aikakaudelle, jossa on ennennäkemätön suorituskyky ja skaalautuvuus.

Lisätietoja Cerebras Systemsista ja Cerebras Inferenssin kokeilemisesta vieraile sivustolla www.cerebras.ai.

Antoine on visionäärisellä johtajalla ja Unite.AI:n perustajakumppani, joka on intohimoisesti omistautunut tulevaisuuden älyteknologian ja robotiikan muotoiluun ja edistämiseen. Sarjayrittäjänä hän uskoo, että älyteknologia tulee olemaan yhtä mullistava yhteiskunnalle kuin sähkö, ja hän on usein innostunut puhumaan älyteknologian ja AGI:n mahdollisuuksista.

Hän on tulevaisuudentutkija, joka on omistautunut tutkimiseen, miten nämä innovaatiot muotoilevat maailmaamme. Lisäksi hän on Securities.io:n perustaja, joka on keskittynyt sijoittamiseen älykkäisiin teknologioihin, jotka määrittelevät tulevaisuutta ja muokkaavat koko toimialoja.