AGI ja tulevaisuuden AI
Inflection-2.5: Tehokas LLM, joka kilpailee GPT-4:n ja Gemini:n kanssa
Inflection AI on tehnyt aaltona suurten kielen mallien (LLM) alalla uuden Inflection-2.5-mallin julkaisemisen myötä, joka kilpailee maailman johtavien LLM-mallien, kuten OpenAI:n GPT-4:n ja Google Gemini:n, kanssa.
Inflection AI:n nopea nousu on saanut lisävauhtia massiivisesta 1,3 miljardin dollarin rahoituskierrokselta, jota johtavat alan jätit, kuten Microsoft (MSFT ), NVIDIA (NVDA ), ja tunnetut sijoittajat, kuten Reid Hoffman, Bill Gates ja Eric Schmidt. Tämä merkittävä sijoitus kasvattaa yhtiön kokonaissijoitusta 1,525 miljardiin dollariin.
Yhteistyössä kumppaneiden CoreWeaven ja NVIDIA:n kanssa Inflection AI rakentaa maailman suurinta tekoälyklusteria, joka koostuu ennätyksellisestä 22 000 NVIDIA H100 Tensor Core -GPU:sta. Tämä valtava laskentakapasiteetti tukee uuden sukupolven suurten tekoälymallien koulutusta ja käyttöönottoa, mahdollistaen Inflection AI:lle rajojen venyttämisen tekoälyn henkilökohtaisten sovellusten alalla. (CRWV )
Yhtiön uraauurtava työ on jo tuottanut merkittäviä tuloksia, ja Inflection AI -klusteri, joka koostuu tällä hetkellä yli 3 500 NVIDIA H100 Tensor Core -GPU:sta, on saavuttanut huipputason suorituskyvyn avoimella MLPerf-benchmarkilla. Yhteistyössä CoreWeaven ja NVIDIA:n kanssa klusteri suoritti viitekoulutustehtävän suurten kielen mallien kanssa vain 11 minuutissa, vahvistaen asemansa nopeimman klusterin tässä benchmarkissa.
Tämä saavutus seuraa Inflection-1:n julkaisua, Inflection AI:n omasta suuresta kielen mallista (LLM), jota on kehuttu parhaaksi malliksi laskentaluokassaan. Ylittäen alan jätit, kuten GPT-3.5:n, LLaMA:n, Chinchillan ja PaLM-540B:n, useilla yleisesti käytetyillä benchmarkkeja, Inflection-1 mahdollistaa käyttäjille vuorovaikutuksen Pi:n, Inflection AI:n henkilökohtaisen tekoälyn, kanssa yksinkertaisella ja luonnollisella tavalla, saaden nopeaa, relevanttia ja hyödyllistä tietoa ja neuvontaa.
Inflection AI:n sitoutuminen avoimuuteen ja toistettavuuteen näkyy Inflection-1:n arvioinnin ja suorituskyvyn julkaisemisessa eri benchmarkkeissa. Muistio paljastaa, että Inflection-1 ylittää malleja samassa laskentaluokassa, määriteltyään malleiksi, jotka on koulutettu käyttäen enintään PaLM-540B:n laskentaoperaatioita (FLOPs).
Inflection-1:n ja yhtiön laskentainfrastruktuurin nopean skaalautumisen menestys, jota edesauttaa merkittävä rahoituskierros, korostaa Inflection AI:n sitoutumista tehtävään luoda henkilökohtainen tekoäly kaikille. Inflection-1:n integroimalla Pi:hen käyttäjät voivat nyt kokea henkilökohtaisen tekoälyn voiman, hyödyntäen sen myötätuntoista luonnetta, hyödyllisyyttä ja turvallisuusstandardeja.
Inflection-2.5
Inflection-2.5 on nyt saatavilla kaikille Pi:n, Inflection AI:n henkilökohtaisen tekoälyavustajan, käyttäjille useilla alustoilla, kuten webissä (pi.ai), iOS:ssä, Androidissa ja uudessa työpöytäsovelluksessa. Tämä integraatio merkitsee merkittävää merkkipaalu Inflection AI:n tehtävään luoda henkilökohtainen tekoäly kaikille, yhdistäen raakavoiman myötätuntoiseen luonteeseen ja turvallisuusstandardeihin.
Loikkaus suorituskyvyssä Inflection AI:n edellinen malli, Inflection-1, käytti noin 4 % GPT-4:n koulutuslaskentaoperaatioista ja näytti keskimäärin noin 72 % GPT-4:n suorituskyvystä eri älykkyyteen suunnattujen tehtävien kanssa. Inflection-2.5:llä Inflection AI on saavuttanut merkittävän loikan Pi:n älyllisissä kyvyissä, keskittyen koodaukseen ja matematiikkaan.
Mallin suorituskyky avainalan benchmarkkeissa osoittaa sen voimassa, näyttäen yli 94 % GPT-4:n keskimääräisestä suorituskyvystä eri tehtävissä, erityisesti STEM-aloilla. Tämä merkittävä saavutus on osoitus Inflection AI:n sitoutumisesta teknologisen eturintaman työntämiseen samalla, kun yhtiö pitää käyttäjäkokemuksen ja turvallisuuden ensisijaisina tavoitteina.
Koodaus- ja matematiikkataito Inflection-2.5 loistaa koodauksessa ja matematiikassa, osoittaen yli 10 %:n parannuksen Inflection-1:een BIG-Bench-Hard-benchmarkissa, joka on haastava osajoukko suurten kielen malleille. Kaksi koodausbenchmarkia, MBPP+ ja HumanEval+, paljastavat massiiviset parannukset Inflection-1:een, vahvistaen Inflection-2.5:n asemaa koodausalueen merkittävänä voimana.
MBPP+-benchmarkissa Inflection-2.5 ylittää edeltäjänsä merkittävällä marginaalilla, näyttäen suorituskyvyn, joka on vertailukelpoinen GPT-4:n suorituskyvyn kanssa, kuten DeepSeek Coder on raportoinut. Samoin HumanEval+-benchmarkissa Inflection-2.5 osoittaa merkittävää edistystä, ylittäen Inflection-1:n suorituskyvyn ja lähestyen GPT-4:n suorituskyvyn tasoa, kuten EvalPlus-johtajan on raportoinut.
Alan Benchmark-johtajuus
Inflection-2.5 erottuu alan benchmarkkeissa, osoittaen merkittäviä parannuksia Inflection-1:een MMLU-benchmarkissa ja GPQA Diamond -benchmarkissa, joka on tunnettu asiantuntijatasoisen haasteellisuutensa vuoksi. Mallin suorituskyky näissä benchmarkkeissa korostaa sen kykyä käsitellä laajaa tehtävien kirjoa, aina lukiolaisuuden tasoisista ongelmista ammattitason haasteisiin.
Menestys STEM-tentteissä Mallin taito ulottuu myös STEM-tentteihin, osoittaen erinomaisen suorituskyvyn Unkarin matematiikkojen tentissä ja Physics GRE:ssä. Unkarin matematiikkojen tentissä Inflection-2.5 osoittaa matemaattista taituruuttaan hyödyntämällä annettua few-shot-ohjeistusta ja muotoilua, jolloin tulokset ovat helppoja toistaa.
Physics GRE:ssä, joka on valintakoe fysiikan opiskelijoille, Inflection-2.5 saavuttaa 85. prosenttipaikan ihmisten suorituskyvyn joukossa (maj@8, enemmistöääni 8:lla), vahvistaen asemansa vankkana kilpailijana fysiikan ongelmanratkaisun alalla. Lisäksi malli lähestyy huipputasoa maj@32:ssa, osoittaen kykynsä ratkaista monimutkaisia fysiikan ongelmia merkittävällä tarkkuudella.
Käyttäjäkokemuksen parantaminen Inflection-2.5 ei ainoastaan ylläpidä Pi:n ominaista myötätuntoista luonnetta ja turvallisuusstandardeja, vaan korostaa sen asemaa monipuolisena ja arvokkaana henkilökohtaisena tekoälyna eri aihealueilla. Käyttäjät voivat keskustella ajankohtaisista tapahtumista, etsiä paikallisia suosituksia, opiskella tenttejä, koodata ja jopa osallistua keskusteluihin, ja Pi, joka on tehostettu Inflection-2.5:llä, lupailee rikkaamman käyttäjäkokemuksen.
Inflection-2.5:n voimakkaat kyvyt mahdollistavat käyttäjille laajemman aihealueen kuin koskaan aiemmin. Mallin kyky käsitellä monimutkaisia tehtäviä, yhdistettynä myötätuntoiseen luonteeseen ja reaaliaikaisiin verkkohakuihin, takaa käyttäjille korkealaatuisen, ajantasaisen tiedon ja ohjauksen.
Käyttäjien omaksuminen ja sitoutuminen Inflection-2.5:n vaikutus Pi:hen on jo näkyvissä käyttäjien mielipiteissä, sitoutumisessa ja pidättämisessä. Inflection AI on todennut merkittävän kiihtymisen organisen käyttäjien kasvussa, jossa yli miljoona päivittäistä ja kuusi miljoonaa kuukausittaista aktiivista käyttäjää vaihtaa yli neljä miljardia viestiä Pi:n kanssa.
Keskustelut Pi:n kanssa kestävät keskimäärin 33 minuuttia, ja yksi kymmenestä kestää yli tunnin päivässä. Lisäksi noin 60 % ihmisistä, jotka keskustelevat Pi:n kanssa tietyssä viikossa, palaavat seuraavalla viikolla, osoittaen korkeamman kuukausittaisen pidättävyyden johtavien kilpailijoiden verrattuna.
Tekniset yksityiskohdat ja benchmark-läpinäkyvyys
Inflection AI:n sitoutuminen avoimuuteen ja toistettavuuteen näkyy myös Inflection-2.5:n teknisissä tuloksissa ja yksityiskohdissa eri alan benchmarkkeissa.
Esimerkiksi oikaistussa MT-Bench-datasetissa, joka osoittaa alkuperäisen datasetin virheitä ja puutteita, Inflection-2.5 osoittaa suorituskyvyn, joka on linjassa odotusten kanssa muiden benchmarkkien perusteella.
Inflection AI on myös arvioinut Inflection-2.5:ttä HellaSwag- ja ARC-C-benchmarkkeissa, jotka ovat yleisiä ymmärryksen ja tieteen benchmarkkeja, ja tulokset osoittavat vahvaa suorituskykyä näillä benchmarkkeilla.
On tärkeää huomata, että vaikka arviot edustavat Pi:ä voimassa pitävää mallia, käyttäjäkokemus voi vaihdella hieman tekijöiden, kuten verkkohakujen (jota ei käytetä benchmarkkeissa), few-shot-ohjeistuksen rakenteen ja muiden tuotannon erojen vuoksi.
Johtopäätös
Inflection-2.5 edustaa merkittävää loikkausta suurten kielen mallien alalla, kilpaillen alan johtavien mallien, kuten GPT-4:n ja Gemini:n, kyvyissä, käyttäen vain murto-osan laskentaresursseista. Sen vaikuttavan suorituskyvyn ansiosta laajalla benchmark-alueella, erityisesti STEM-aloilla, koodauksessa ja matematiikassa, Inflection-2.5 on asettanut itsensä vankkana kilpailijana tekoälymaisemassa.
Inflection-2.5:n integroiminen Pi:hen, Inflection AI:n henkilökohtaiseen tekoälyavustajaan, lupailee rikkaamman käyttäjäkokemuksen, yhdistäen raakavoiman myötätuntoiseen luonteeseen ja turvallisuusstandardeihin. Kun Inflection AI jatkaa tekoälyrajan työntämistä, tekoälyyhteisö odottaa innostuneena seuraavaa innovaatioaaltoa ja läpimurtoja tästä uraauurtavasta yhtiöstä.














