AI-modeller og plattformer

Microsoft lanserer Phi-3: Kraftfulle åpne AI-modeller som leverer topp ytelse i små størrelser

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Microsoft (MSFT ) har introdusert Phi-3, en ny familie av små språkmodeller (SLM) som har som mål å levere høy ytelse og kostnadseffektivitet i AI-applikasjoner. Disse modellene har vist sterke resultater over benchmarks i språkforståelse, resonnering, kode og matematikk når de sammenlignes med modeller av samme og større størrelse. Lanseringen av Phi-3 utvider valgmulighetene for utviklere og bedrifter som ønsker å utnytte AI samtidig som de balanserer effisiens og kostnader.

Phi-3-modellfamilie og tilgjengelighet

Den første modellen i Phi-3-linjen er Phi-3-mini, en 3,8 milliarder parametermodell som nå er tilgjengelig på Azure AI Studio, Hugging Face og Ollama. Phi-3-mini kommer instruksjonsjustert, noe som gjør det mulig å bruke den “utenfor esken” uten omfattende finjustering. Den har en kontekstvindu på opptil 128K token, det lengste i sin størrelsesklasse, og muliggjør prosessering av større tekstinnputt uten å ofre ytelse.

For å optimalisere ytelse over ulike maskinkonfigurasjoner, er Phi-3-mini finjustert for ONNX Runtime og NVIDIA-GPUer. Microsoft planlegger å utvide Phi-3-familien snart med lanseringen av Phi-3-small (7 milliarder parametre) og Phi-3-medium (14 milliarder parametre). Disse ekstra modellene vil gi en bredere rekke valgmuligheter for å møte diverse behov og budsjetter.

Bilde: Microsoft

Phi-3-ytelse og utvikling

Microsoft rapporterer at Phi-3-modellene har vist betydelige forbedringer i ytelse sammenlignet med modeller av samme størrelse og enda større modeller over ulike benchmarks. Ifølge selskapet, har Phi-3-mini overgått modeller som er dobbelt så store i språkforståelse og generering, mens Phi-3-small og Phi-3-medium har overgått mye større modeller, som GPT-3,5T, i visse evalueringer.

Microsoft hevder at utviklingen av Phi-3-modellene har fulgt selskapets prinsipper og standarder for ansvarlig AI, som betoner ansvar, transparens, rettferdighet, pålitelighet, sikkerhet, personvern og inklusivitet. Modellene har angivelig gjennomgått sikkerhetstrenings-, evalueringer og rødteam-øvelser for å sikre overholdelse av ansvarlig AI-utviklingspraksis.

Bilde: Microsoft

Potensielle anvendelser og muligheter for Phi-3

Phi-3-familien er designet for å utmerke seg i scenarier der ressurser er begrensede, lav latens er essensiell eller kostnadseffektivitet er en prioritet. Disse modellene har potensialet til å muliggjøre enhetsinterferens, som gjør det mulig for AI-drevne applikasjoner å kjøre effektivt på en rekke enheter, inkludert de med begrenset beregningskraft. Den mindre størrelsen på Phi-3-modellene kan også gjøre finjustering og tilpasning mer rimelig for bedrifter, slik at de kan tilpasse modellene til sine spesifikke bruksscenarier uten å pådra seg høye kostnader.

I applikasjoner der rask respons er kritisk, tilbyr Phi-3-modellene et løftende løsning. Deres optimerte arkitektur og effektiv prosessering kan muliggjøre rask generering av resultater, som forbedrer brukeropplevelsen og åpner opp muligheter for sanntids AI-interaksjoner. I tillegg er Phi-3-minis sterke resonnerings- og logiske evner godt egnet for analytiske oppgaver, som dataanalyse og innsiktsgenerering.

Ettersom Phi-3-modellene kommer i bruk i virkelige applikasjoner, blir potensialet for disse modellene til å drive innovasjon og gjøre AI mer tilgjengelig stadig mer tydelig. Phi-3-familien representerer en milepæl i demokratiseringen av AI, og gir bedrifter og utviklere mulighet til å utnytte kraften av avanserte språkmodeller samtidig som de opprettholder effisiens og kostnadseffektivitet.

Med lanseringen av Phi-3, presser Microsoft grensene for hva som er mulig med små språkmodeller, og åpner veien for en fremtid der AI kan integreres sømløst i en rekke applikasjoner og enheter.

Alex McFarland er en AI-journalist og forfatter som utforsker de nyeste utviklingene innen kunstig intelligens. Han har samarbeidet med tallrike AI-startups og publikasjoner verden over.