AI-modeller og plattformer
Microsoft lanserer Phi-3: Kraftfulle åpne AI-modeller som leverer topp ytelse i små størrelser
Microsoft (MSFT ) har introdusert Phi-3, en ny familie av små språkmodeller (SLM) som har som mål å levere høy ytelse og kostnadseffektivitet i AI-applikasjoner. Disse modellene har vist sterke resultater over benchmarks i språkforståelse, resonnering, kode og matematikk når de sammenlignes med modeller av samme og større størrelse. Lanseringen av Phi-3 utvider valgmulighetene for utviklere og bedrifter som ønsker å utnytte AI samtidig som de balanserer effisiens og kostnader.
Phi-3-modellfamilie og tilgjengelighet
Den første modellen i Phi-3-linjen er Phi-3-mini, en 3,8 milliarder parametermodell som nå er tilgjengelig på Azure AI Studio, Hugging Face og Ollama. Phi-3-mini kommer instruksjonsjustert, noe som gjør det mulig å bruke den “utenfor esken” uten omfattende finjustering. Den har en kontekstvindu på opptil 128K token, det lengste i sin størrelsesklasse, og muliggjør prosessering av større tekstinnputt uten å ofre ytelse.
For å optimalisere ytelse over ulike maskinkonfigurasjoner, er Phi-3-mini finjustert for ONNX Runtime og NVIDIA-GPUer. Microsoft planlegger å utvide Phi-3-familien snart med lanseringen av Phi-3-small (7 milliarder parametre) og Phi-3-medium (14 milliarder parametre). Disse ekstra modellene vil gi en bredere rekke valgmuligheter for å møte diverse behov og budsjetter.

Bilde: Microsoft
Phi-3-ytelse og utvikling
Microsoft rapporterer at Phi-3-modellene har vist betydelige forbedringer i ytelse sammenlignet med modeller av samme størrelse og enda større modeller over ulike benchmarks. Ifølge selskapet, har Phi-3-mini overgått modeller som er dobbelt så store i språkforståelse og generering, mens Phi-3-small og Phi-3-medium har overgått mye større modeller, som GPT-3,5T, i visse evalueringer.
Microsoft hevder at utviklingen av Phi-3-modellene har fulgt selskapets prinsipper og standarder for ansvarlig AI, som betoner ansvar, transparens, rettferdighet, pålitelighet, sikkerhet, personvern og inklusivitet. Modellene har angivelig gjennomgått sikkerhetstrenings-, evalueringer og rødteam-øvelser for å sikre overholdelse av ansvarlig AI-utviklingspraksis.

Bilde: Microsoft
Potensielle anvendelser og muligheter for Phi-3
Phi-3-familien er designet for å utmerke seg i scenarier der ressurser er begrensede, lav latens er essensiell eller kostnadseffektivitet er en prioritet. Disse modellene har potensialet til å muliggjøre enhetsinterferens, som gjør det mulig for AI-drevne applikasjoner å kjøre effektivt på en rekke enheter, inkludert de med begrenset beregningskraft. Den mindre størrelsen på Phi-3-modellene kan også gjøre finjustering og tilpasning mer rimelig for bedrifter, slik at de kan tilpasse modellene til sine spesifikke bruksscenarier uten å pådra seg høye kostnader.
I applikasjoner der rask respons er kritisk, tilbyr Phi-3-modellene et løftende løsning. Deres optimerte arkitektur og effektiv prosessering kan muliggjøre rask generering av resultater, som forbedrer brukeropplevelsen og åpner opp muligheter for sanntids AI-interaksjoner. I tillegg er Phi-3-minis sterke resonnerings- og logiske evner godt egnet for analytiske oppgaver, som dataanalyse og innsiktsgenerering.












