AI-modeller og platforme

Llama 3.1: Metas mest avancerede open-source AI-model – Alt, du behøver at vide

mm
Føj Unite.AI til dine foretrukne kilder på Google

Meta har offentliggjort Llama 3.1, deres seneste og mest avancerede store sprogmodel, hvilket markerer et betydeligt spring i AI-kapaciteter og tilgængelighed. Denne nye udgave er i overensstemmelse med Metas engagement i at gøre AI åbent tilgængelig, som understrekes af Mark Zuckerberg, der mener, at open-source AI er fordelagtigt for udviklere, Meta og samfundet som helhed.

Til at introducere Llama 3.1 skrev Mark Zuckerberg en detaljeret blogpost med titlen “Open Source AI Is the Path Forward“, hvor han fremstiller sin vision for fremtiden for AI. Han tegner en parallel mellem udviklingen af Unix til Linux og den nuværende udvikling af AI, hvori han understreger, at open-source AI ultimativt vil føre industrien. Zuckerberg fremhæver fordelene ved open-source AI, herunder tilpasning, omkostningseffektivitet, datasikkerhed og undgåelse af vendor-lås.

Han mener, at open-source-udvikling fremmer innovation, skaber en robust økosystem og sikrer retfærdig adgang til AI-teknologi. Zuckerberg behandler også bekymringer om sikkerhed og fremhæver, at open-source AI gennem transparens og fællesskabsundersøgelser kan være sikrere end lukkede modeller som OpenAI’s GPT-modeller.

Metas engagement i open-source AI har til formål at opbygge de bedste oplevelser og tjenester, fri for begrænsningerne i lukkede økosystemer. Han afslutter med at invitere udviklere og organisationer til at deltage i opbygningen af en fremtid, hvor AI kan gavne alle, og fremme samarbejde og kontinuerlig udvikling.

Nøglepunkter

  • Åben tilgængelighed: Meta fortsætter sit engagement i open-source AI med det formål at demokratisere adgang og innovation.
  • Forbedrede kapaciteter: Llama 3.1 har en kontekstlængde på 128K, understøtter otte sprog og introducerer Llama 3.1 405B, den første open-source AI-model på frontniveau.
  • Ubegrænset fleksibilitet og kontrol: Llama 3.1 405B tilbyder state-of-the-art-kapaciteter, der er sammenlignelige med førende lukkede modeller, og muliggør nye arbejdsprocesser som syntetisk datagenerering og modeldestillation.
  • Komplet økosystemstøtte: Med over 25 partnere, herunder store teknologivirksomheder som AWS, NVIDIA (NVDA ) og Google Cloud, er Llama 3.1 klar til brug på tværs af forskellige platforme.

Llama 3.1 Oversigt

State-of-the-art-kapaciteter

Llama 3.1 405B er designet til at være på niveau med de bedste AI-modeller, der er tilgængelige i dag. Den excellerer i almen viden, styrebarhed, matematik, værktøjsbrug og flersproget oversættelse. Denne model forventes at drive innovation inden for områder som syntetisk datagenerering og modeldestillation, og tilbyder hidtil usete muligheder for vækst og udforskning.

Opgraderede modeller

Udgivelsen inkluderer forbedrede versioner af 8B- og 70B-modellerne, der nu understøtter multiple sprog og har forlængede kontekstlængder på op til 128K. Disse forbedringer muliggør avancerede anvendelser som langformstekstsummering, flersprogede samtaleagenter og kodestøtte.

Open-source-tilgængelighed

I overensstemmelse med sin open-source-filosofi udgiver Meta disse modeller til download på Meta og Hugging Face. Udviklere kan bruge disse modeller til en række anvendelser, herunder forbedring af andre modeller, og kan køre dem i forskellige miljøer, fra on-premises til cloud og lokale installationer.

Modelvurderinger og arkitektur

Omfattende vurderinger

Llama 3.1 er blevet testet på over 150 benchmark-datasæt på multiple sprog og sammenlignet med førende modeller som GPT-4 og Claude 3.5 Sonnet. Resultaterne viser, at Llama 3.1 er konkurrencedygtig på tværs af en bred vifte af opgaver, og cementerer derved sin plads blandt topmodellerne.

Avancerede træningsmetoder

Træning af 405B-modellen involverede behandling af over 15 billioner tokens ved hjælp af mere end 16.000 H100-GPU’er. Meta anvendte en standard decoder-kun transformer-model med iterative post-træningsprocedurer, herunder overvåget finjustering og direkte præferenceoptimering, for at opnå højkvalitets syntetisk data og overlegen præstation.

Effektiv inferens

For at understøtte storstilets produktionsinferens blev Llama 3.1-modellerne kvantificeret fra 16-bit til 8-bit-numerik, hvilket reducerer beregningskravene og tillader, at modellen kan køre effektivt på en enkelt servernode.

Instruktions- og chatsfinjustering

Meta fokuserede på at forbedre modellens evne til at følge detaljerede instruktioner og opretholde høje niveauer af sikkerhed. Dette involverede flere runder af justering oven på den fortrænede model, ved hjælp af syntetisk datagenerering og rigorøse dataprocesseringsteknikker for at sikre højkvalitetsudgang på tværs af alle kapaciteter.

Llama-systemet

Llama 3.1 er en del af et bredere system, der er designet til at fungere med forskellige komponenter, herunder eksterne værktøjer. Meta har til formål at give udviklere fleksibiliteten til at skabe brugerdefinerede anvendelser og adfærd. Udgivelsen inkluderer Llama Guard 3 og Prompt Guard til forbedret sikkerhed og sikkerhed.

Llama Stack API

Meta udgiver en anmodning om kommentar til Llama Stack API, en standardgrænseflade til at lette brugen af Llama-modeller af tredjepartsprojekter. Denne initiativ har til formål at strømline samarbejde og reducere barrierer for udviklere og platformudbydere.

Bygning med Llama 3.1 405B

Llama 3.1 405B tilbyder omfattende kapaciteter for udviklere, herunder realtids- og batchinferens, overvåget finjustering, modelveurdering, kontinuerlig fortræning, retrieval-augmented generation (RAG), funktionskald og syntetisk datagenerering. På dagen for udgivelsen kan udviklere starte med at bygge med disse avancerede funktioner, understøttet af partnere som AWS, NVIDIA og Databricks.

Prøv Llama 3.1 i dag

Llama 3.1-modeller er tilgængelige for download og umiddelbar udvikling. Meta opfordrer fællesskabet til at udforske potentialet for disse modeller og bidrage til den voksende økosystem. Med robuste sikkerhedsforanstaltninger og open-source-adgang er Llama 3.1 klar til at drive den næste bølge af AI-innovation.

Konklusion

Llama 3.1 repræsenterer en betydelig milepæl i udviklingen af open-source AI, og tilbyder ubegrænsede kapaciteter og fleksibilitet. Metas engagement i åben tilgængelighed sikrer, at flere mennesker kan drage fordel af AI-fremgang, og fremmer innovation og retfærdig teknologiudvikling. Med Llama 3.1 er mulighederne for nye anvendelser og forskning enorme, og Meta ser frem til de banebrydende udviklinger, som fællesskabet vil opnå med dette kraftfulde værktøj.

Læsere, der ønsker at lære mere, skal læse Mark Zuckerbergs detaljerede blogindlæg.

Antoine er en visionær leder og medstifter af Unite.AI, drevet af en urokkelig passion for at forme og fremme fremtiden for AI og robotteknologi. En serieiværksætter, han tror, at AI vil være lige så omvæltende for samfundet som elektricitet, og han bliver ofte fanget i at tale om potentialet for omvæltende teknologier og AGI.

Som en futurist, er han dedikeret til at udforske, hvordan disse innovationer vil forme vores verden. Derudover er han grundlægger af Securities.io, en platform, der fokuserer på at investere i skarp teknologi, der gendefinerer fremtiden og omformer hele sektorer.