AI-modellen en platforms
Google maakt AI-training 28% sneller met SLM’s als leraren
Het trainen van grote taalmodellen (LLM’s) is voor de meeste organisaties buiten bereik geraakt. Met kosten die in de miljoenen lopen en compute-eisen die een supercomputer zouden doen zweten, is AI-ontwikkeling achter de deuren van tech-reuzen blijven steken. Maar Google (GOOGL ) heeft dit verhaal nu op zijn kop gezet met een benadering die zo eenvoudig is dat je je afvraagt waarom niemand er eerder aan dacht: het gebruik van kleinere AI-modellen als leraren.
Hoe SALT werkt: een nieuwe benadering voor het trainen van AI-modellen
In een recent onderzoeksartikel met de titel “A Little Help Goes a Long Way: Efficient LLM Training by Leveraging Small LMs,” introduceerden Google Research en DeepMind SALT (Small model Aided Large model Training). Dit is de novelle methode die onze traditionele benadering van het trainen van LLM’s uitdaagt.
Waarom is dit onderzoek belangrijk? Het trainen van grote AI-modellen is momenteel als proberen iemand alles te leren over een onderwerp in één keer – het is inefficiënt, duur en vaak beperkt tot organisaties met enorme compute-middelen. SALT neemt een andere route, met een tweestaps trainingsproces dat zowel innovatief als praktisch is.
Hoe SALT werkelijk werkt:
Stap 1: Kennisoverdracht
- Een kleinere taalmodel (SLM) fungeert als leraar, delend zijn begrip met het grotere model
- Het kleinere model richt zich op het overdragen van zijn “verworven kennis” via wat onderzoekers “zachte labels” noemen
- Denk hierbij aan een leraar die de basisbeginselen behandelt voordat een student verder gaat met geavanceerde onderwerpen
- Deze stap is vooral effectief in “gemakkelijke” leerregio’s – gebieden waar het kleinere model sterke voorspellende vertrouwen heeft
Stap 2: Zelfstandig leren
- Het grotere model gaat over tot onafhankelijk leren
- Het richt zich op het beheersen van complexe patronen en moeilijke taken
- Dit is waar het model capaciteiten ontwikkelt die verder gaan dan wat zijn kleinere “leraar” had kunnen bieden
- De overgang tussen stappen gebruikt zorgvuldig ontworpen strategieën, waaronder lineaire afname en lineaire verhoudingsafname van het distillatieverliesgewicht
In niet-technische termen kun je je voorstellen dat het kleinere AI-model als een behulpzame leraar fungeert die het grotere model in de beginfase van de training begeleidt. Deze leraar biedt extra informatie aan samen met zijn antwoorden, waarbij hij aangeeft hoe zeker hij is van elk antwoord. Deze extra informatie, bekend als “zachte labels”, helpt het grotere model sneller en effectiever te leren.
- Lineaire afname: Het is alsof je langzaam het volume van de stem van de leraar verlaagt. De leiding van de leraar wordt minder prominent met elke stap, waardoor het grotere model zich meer kan richten op het leren van de ruwe gegevens zelf.
- Lineaire verhoudingsafname: Dit is alsof je de balans tussen het advies van de leraar en de oorspronkelijke taak aanpast. Naarmate de training vordert, verschuift de nadruk meer naar de oorspronkelijke taak, terwijl het advies van de leraar minder dominant wordt.
De resultaten zijn overtuigend. Toen Google-onderzoekers SALT testten met een 1,5 miljard parameter SLM om een 2,8 miljard parameter LLM te trainen op de Pile-dataset, zagen ze:
- Een reductie van 28% in de trainingsduur in vergelijking met traditionele methoden
- Aanzienlijke prestatieverbeteringen na fine-tuning:
- Wiskundige probleemnauwkeurigheid steeg tot 34,87% (vergeleken met 31,84% baseline)
- Leesbegrip bereikte 67% nauwkeurigheid (op van 63,7%)
Maar wat SALT echt innovatief maakt, is zijn theoretisch kader. De onderzoekers ontdekten dat zelfs een “zwakkere” leraarmodel de prestaties van de leerling kan verbeteren door een “gunstige bias-variance-trade-off” te bereiken. In eenvoudige bewoordingen helpt het kleinere model het grotere model om fundamentele patronen efficiënter te leren, waardoor een sterker fundament voor geavanceerd leren ontstaat.
Waarom SALT de AI-ontwikkelingsarena kan herschikken
Herinner je je wanneer cloud computing bepaalde wie een techbedrijf kon starten? SALT kan hetzelfde doen voor AI-ontwikkeling.
Ik volg AI-trainingsinnovaties al jaren, en de meeste doorbraken hebben voornamelijk de techreuzen gebaat. Maar SALT is anders.
Dit is wat het voor de toekomst kan betekenen:
Voor organisaties met beperkte middelen:
- Je hebt misschien geen enorme compute-infrastructuur meer nodig om capabele AI-modellen te ontwikkelen
- Kleinere onderzoeksinstellingen en bedrijven kunnen experimenteren met het ontwikkelen van aangepaste modellen
- De reductie van 28% in de trainingsduur vertaalt zich rechtstreeks naar lagere compute-kosten
- Nog belangrijker, je kunt beginnen met bescheiden compute-middelen en nog steeds professionele resultaten behalen
Voor het AI-ontwikkelingslandschap:
- Meer spelers kunnen de markt betreden, wat leidt tot meer diverse en gespecialiseerde AI-oplossingen
- Universiteiten en onderzoeksinstellingen kunnen meer experimenten uitvoeren met hun bestaande middelen
- De toegangsdrempel voor AI-onderzoek daalt aanzienlijk
- We kunnen nieuwe toepassingen zien in gebieden die eerder geen AI-ontwikkeling konden betalen
Wat dit voor de toekomst betekent
Door kleinere modellen als leraren te gebruiken, maken we AI-training niet alleen efficiënter, maar veranderen we ook fundamenteel wie kan deelnemen aan AI-ontwikkeling. De implicaties gaan verder dan alleen technische verbeteringen.
Belangrijke punten om in gedachten te houden:
- Een reductie van 28% in de trainingsduur is het verschil tussen het starten van een AI-project of het als onbereikbaar beschouwen
- De prestatieverbeteringen (34,87% op wiskundige taken, 67% op leestaken) laten zien dat toegankelijkheid niet altijd betekent dat je moet inboeten op kwaliteit
- SALT’s benadering bewijst dat soms de beste oplossingen voortkomen uit het heroverwegen van fundamenten in plaats van alleen maar meer compute-macht toe te voegen
Wat te verwachten:
- Houd in de gaten of kleinere organisaties beginnen met het ontwikkelen van aangepaste AI-modellen
- Kijk uit naar nieuwe toepassingen in gebieden die eerder geen AI-ontwikkeling konden betalen
- Let op innovaties in het gebruik van kleinere modellen voor gespecialiseerde taken
Onthoud: De werkelijke waarde van SALT ligt in hoe het de AI-ontwikkelingsarena kan herschikken. Of je nu een onderzoeksinstelling runt, een techteam beheert of gewoon geïnteresseerd bent in AI-ontwikkeling, dit is het soort doorbraak dat je volgende grote idee mogelijk kan maken.
Misschien moet je beginnen na te denken over dat AI-project dat je eerder onbereikbaar achtte. Het kan meer mogelijk zijn dan je je had voorgesteld.










