AI-modeller och plattformar

Hur Google minskade AI-utbildningskraven med 10 000 gånger

mm
Lägg till Unite.AI bland dina föredragna källor på Google

Den artificiella intelligensindustrin står inför en grundläggande paradox. Medan maskiner nu kan bearbeta data i enorma mängder, är inlärningen förvånansvärt ineffektiv och möter utmaningen med avtagande avkastning. Traditionella maskinlärningsmetoder kräver enorma, märkta datamängder som kan kosta miljontals dollar och ta år att skapa. Dessa metoder fungerar vanligtvis under antagandet att mer data leder till bättre AI-modeller. Men Google (GOOGL ) -forskare har nyligen introducerat en innovativ metod som utmanar denna långvariga tro. De visar att liknande AI-prestanda kan uppnås med upp till 10 000 gånger mindre träningsdata. Denna utveckling har potentialen att fundamentalt förändra hur vi närmar oss AI. I denna artikel kommer vi att utforska hur Google-forskare uppnådde denna genombrott, den potentiella framtida påverkan av utvecklingen och de utmaningar och riktningar som ligger framför.

Den stora datautmaningen i AI

Under decennier har mantran “mer data är bättre AI” drivit industrins tillvägagångssätt för AI. Stora språkmodeller som GPT-4 konsumerar biljoner token under utbildning. Detta datahungriga tillvägagångssätt skapar en betydande barriär för organisationer som saknar omfattande resurser eller specialiserade datamängder. Först är kostnaden för mänsklig märkning betydligt hög. Experter på märkning tar ut höga avgifter, och den enorma mängden data som behövs gör projekt dyra. Andra är att de flesta insamlade data ofta är redundant och kan inte spela en avgörande roll i inlärningsprocessen. Den traditionella metoden kämpar också med förändrade krav. När policyn ändras eller nya typer av problematiskt innehåll uppstår, måste företag starta märkningsprocessen från scratch. Denna process skapar en konstant cykel av dyra datainsamling och modellomträning.

Att hantera stora datautmaningar med aktivt lärande

En av de kända sätten att hantera dessa datautmaningar är genom att ge kraft åt aktivt lärande. Detta tillvägagångssätt bygger på en noggrann urvalprocess som identifierar de mest värdefulla träningsexemplen för mänsklig märkning. Den underliggande idén är att modeller lär sig bäst från exempel som de finner mest förvirrande, snarare än att passivt konsumera all tillgänglig data. Till skillnad från traditionella AI-metoder, som kräver stora datamängder, tar aktivt lärande ett mer strategiskt tillvägagångssätt genom att fokusera på att samla in endast de mest informativa exemplen. Detta tillvägagångssätt hjälper till att undvika ineffektiviteten i märkning av uppenbara eller redundanta data som ger liten värde till modellen. Istället fokuserar aktivt lärande på gränsfall och osäkra exempel som har potentialen att förbättra modellens prestanda avsevärt.

Genom att koncentrera experternas ansträngningar på dessa nyckelexempel, tillåter aktivt lärande modeller att lära sig snabbare och mer effektivt med betydligt färre datapunkter. Detta tillvägagångssätt har potentialen att hantera både dataflaskan och ineffektiviteten i traditionella maskinlärningsmetoder.

Googles aktivt lärande-tillvägagångssätt

Googles forskarteam har framgångsrikt använt sig av detta paradigm. Deras nya aktivt lärande-metodik visar att noggrant utvalda, högkvalitativa exempel kan ersätta stora mängder märkt data. Till exempel visar de att modeller som tränats på färre än 500 experter-märkta exempel matchar eller överträffar prestandan hos system som tränats på 100 000 traditionella märkningar.

Processen fungerar genom vad Google kallar ett “LLM-as-Scout”-system. Den stora språkmodellen scannar först igenom stora mängder omarkerad data och identifierar fall där den känner sig mest osäker. Dessa gränsfall representerar exakt de scenarier där modellen behöver mänsklig vägledning för att förbättra sitt beslutsfattande. Processen börjar med en initial modell som märker stora datamängder med grundläggande prompter. Systemet klustrar sedan exempel efter deras förutsagda klassificeringar och identifierar områden där modellen visar förvirring mellan olika kategorier. Dessa överlappande kluster avslöjar de exakta punkterna där expertmänsklig bedömning kan bli mest värdefull.

Metodiken riktar sig explicit mot par av exempel som ligger närmast varandra men bär olika märkningar. Dessa gränsfall representerar exakt de scenarier där mänsklig expertis är viktigast. Genom att koncentrera expertmärkningsansträngningar på dessa förvirrande exempel, uppnår systemet anmärkningsvärda effektivitetsvinster.

Kvalitet över kvantitet

Forskningen visar en nyckelfyndning om datakvalitet som utmanar ett vanligt antagande inom AI. Den visar att expertmärkningar, med deras höga trohet, konsekvent överträffar storskaliga crowdsourcade anteckningar. De mätte detta med hjälp av Cohens Kappa, ett statistiskt verktyg som bedömer hur väl modellens förutsägelser stämmer överens med expertåsikter, utöver vad som skulle hända av en slump. I Googles experiment uppnådde experter på märkning Cohens Kappa-poäng över 0,8, vilket betydligt överträffade vad crowdsourcing vanligtvis tillhandahåller.

Denna högre konsekvens tillåter modeller att lära sig effektivt från betydligt färre exempel. I tester med Gemini Nano-1 och Nano-2, matchade eller överträffade modellerna expertmärkning med endast 250-450 noggrant utvalda exempel, jämfört med runt 100 000 slumpmässiga crowdsourcade märkningar. Det är en minskning med tre till fyra storleksordningar. Men fördelarna är inte bara begränsade till att använda mindre data. Modeller som tränats med detta tillvägagångssätt överträffar ofta de som tränats med traditionella metoder. För komplexa uppgifter och större modeller, nådde prestandaförbättringarna 55-65% över baslinjen, vilket visar en mer betydande och tillförlitlig överensstämmelse med policyexperter.

Varför denna genombrott är viktigt nu

Denna utveckling kommer vid en kritisk tidpunkt för AI-industrin. När modellerna växer och blir mer avancerade, har det traditionella tillvägagångssättet att skala utbildningsdata blivit alltmer ohållbart. Den miljömässiga kostnaden för att träna stora modeller fortsätter att växa, och de ekonomiska barriärerna för inträde förblir höga för många organisationer.

Googles metod hanterar flera industritillvägagångssätt samtidigt. Den dramatiska minskningen av märkningskostnader gör AI-utveckling mer tillgänglig för mindre organisationer och forskarteam. De snabbare iterationscyklerna möjliggör snabb anpassning till förändrade krav, vilket är avgörande i dynamiska områden som innehållsmoderering eller cybersäkerhet.

Tillvägagångssättet har också bredare implikationer för AI-säkerhet och tillförlitlighet. Genom att fokusera på de fall där modellerna är mest osäkra, identifierar metoden naturligt potentiella felmoder och gränsfall. Denna process skapar mer robusta system som bättre förstår sina begränsningar.

De bredare implikationerna för AI-utveckling

Denna genombrott antyder att vi kan vara på väg in i en ny fas av AI-utveckling där effektivitet är viktigare än skala. Det traditionella “större är bättre”-tillvägagångssättet för utbildningsdata kan ge vika för mer avancerade metoder som prioriterar datakvalitet och strategiskt urval.

De miljömässiga implikationerna är betydande. Utbildning av stora AI-modeller kräver för närvarande enorma beräkningsresurser och energiförbrukning. Om liknande prestanda kan uppnås med dramatiskt mindre data, kan AI-utvecklingens koldioxidavtryck minska avsevärt.

Den demokratiserande effekten kan vara lika viktig. Mindre forskarteam och organisationer som tidigare inte kunde bekosta stora datainsamlingseffekter har nu en möjlighet att skapa konkurrenskraftiga AI-system. Denna utveckling kan accelerera innovation och skapa mer diversifierade perspektiv inom AI-utveckling.

Begränsningar och överväganden

Trots de lovande resultaten, står metodiken inför flera praktiska utmaningar. Kravet på experter på märkning med Cohens Kappa-poäng över 0,8 kan begränsa tillämpligheten i områden som saknar tillräcklig expertis eller tydliga utvärderingskriterier. Forskningen fokuserar primärt på klassificeringsuppgifter och innehållssäkerhetsapplikationer. Om samma dramatiska förbättringar gäller för andra typer av AI-uppgifter som språkgenerering eller resonemang återstår att se.

Den iterativa naturen av aktivt lärande introducerar komplexitet jämfört med traditionella batchbearbetningsmetoder. Organisationer måste utveckla nya arbetsflöden och infrastruktur för att stödja de fråge-svars-cyklerna som möjliggör kontinuerlig modellförbättring.

Framtida forskning kommer sannolikt att undersöka automatiserade metoder för att upprätthålla expertnivåmärkningskvalitet och utveckla domänspecifika anpassningar av den grundläggande metodiken. Integreringen av aktivt lärande-principer med andra effektivitetstekniker, som parameter-effektiv finjustering, kan ge ytterligare prestandavinster.

Slutsatsen

Googles forskning visar att riktade, högkvalitativa data kan vara mer effektiva än stora datamängder. Genom att fokusera på att märka endast de mest värdefulla exemplen, minskade de utbildningsbehoven med upp till 10 000 gånger samtidigt som de förbättrade prestandan. Detta tillvägagångssätt sänker kostnaderna, accelererar utvecklingen, minskar miljöpåverkan och gör avancerad AI mer tillgänglig. Det markerar en betydande skiftning mot effektiv och hållbar AI-utveckling.

Dr. Tehseen Zia är en fast anställd biträdande professor vid COMSATS University Islamabad, med en doktorsexamen i AI från Vienna University of Technology, Österrike. Specialiserad på artificiell intelligens, maskinlärning, datavetenskap och datorseende, har han gjort betydande bidrag med publikationer i ansedda vetenskapliga tidskrifter. Dr. Tehseen har också lett olika industriprojekt som huvudutredare och tjänstgjort som AI-konsult.