Modele și platforme AI
Cum a redus Google cerințele de antrenare a inteligenței artificiale de 10.000 de ori
Industria inteligenței artificiale se confruntă cu o paradoxă fundamentală. În timp ce mașinile pot procesa date la scară largă, învățarea rămâne surprinzător de ineficientă, confruntându-se cu provocarea randamentului descrescător. Abordările tradiționale de învățare automată necesită seturi de date masive și etichetate, care pot costa milioane de dolari și pot dura ani pentru a fi create. Aceste abordări funcționează, de obicei, sub presupunerea că mai multe date duc la modele de inteligență artificială mai bune. Cu toate acestea, cercetătorii de la Google (GOOGL ) au introdus recent o metodă inovatoare care contestă această credință de lungă durată. Ei demonstrează că se poate obține o performanță similară a inteligenței artificiale cu până la 10.000 de ori mai puține date de antrenare. Acest progres are potențialul de a schimba fundamental modul în care abordăm inteligența artificială. În acest articol, vom explora cum cercetătorii de la Google au realizat acest progres, impactul potențial al acestui progres și provocările și direcțiile viitoare.
Provocarea datelor mari în inteligența artificială
De decenii, mantra “mai multe date înseamnă o inteligență artificială mai bună” a condus abordarea industriei față de inteligența artificială. Modelele de limbaj mare, cum ar fi GPT-4, consumă trilioane de tokeni în timpul antrenării. Acestă abordare care necesită multe date creează o barieră semnificativă pentru organizațiile care nu au resurse extinse sau seturi de date specializate. În primul rând, costul etichetării de către oameni este semnificativ de ridicat. Anotatorii experți percep tarife ridicate, iar volumul imens de date necesare face proiectele scumpe. În al doilea rând, cea mai mare parte a datelor colectate este adesea redundantă și nu joacă un rol crucial în procesul de învățare. Abordarea tradițională se confruntă, de asemenea, cu provocări legate de cerințele în schimbare. Când politicile se schimbă sau apar noi tipuri de conținut problematic, companiile trebuie să pornească procesul de etichetare de la zero. Acest proces creează un ciclu constant de colectare a datelor și reantrenare a modelului.
Abordarea provocărilor datelor mari cu învățarea activă
Una dintre modalitățile cunoscute de a aborda aceste provocări ale datelor este prin împuternicirea învățării active. Această abordare se bazează pe un proces de selecție atentă care identifică exemplele de antrenare cele mai valoroase pentru etichetarea de către oameni. Ideea de bază este că modelele învață cel mai bine din exemplele pe care le găsesc mai puțin clare, și nu consumă pasiv toate datele disponibile. În contrast cu metodele tradiționale de inteligență artificială, care necesită seturi de date mari, învățarea activă adoptă o abordare mai strategică, concentrându-se pe colectarea numai a exemplarelor cele mai informative. Această abordare ajută la evitarea ineficienței etichetării datelor evidente sau redundante care oferă puțină valoare modelului. În schimb, învățarea activă se concentrează pe cazurile limită și exemplele incerte care au potențialul de a îmbunătăți semnificativ performanța modelului.
Prin concentrarea eforturilor experților pe aceste exemple cheie, învățarea activă permite modelului să învețe mai rapid și mai eficient cu mult mai puține puncte de date. Această abordare are potențialul de a aborda atât blocajul datelor, cât și ineficiențele abordărilor tradiționale de învățare automată.
Abordarea de învățare activă a Google
Echipa de cercetare a Google a aplicat cu succes acest paradigme. Noua metodologie de învățare activă demonstrează că exemplele atent selectate și de înaltă calitate pot înlocui cantități uriașe de date etichetate. De exemplu, ei arată că modelele antrenate pe mai puțin de 500 de exemple etichetate de experți au egalat sau au depășit performanța sistemelor antrenate pe 100.000 de etichete tradiționale.
Procesul funcționează prin ceea ce Google numește un sistem “LLM-as-Scout”. Modelul de limbaj mare scanează inițial cantități uriașe de date neetichetate, identificând cazurile în care se simte cel mai nesigur. Aceste cazuri limită reprezintă exact scenariile în care modelul are nevoie de îndrumarea umană pentru a-și îmbunătăți procesul de luare a deciziilor. Procesul începe cu un model inițial care etichetează seturi de date mari folosind prompturi de bază. Sistemul clusterizează apoi exemplele în funcție de clasificările lor predictate și identifică regiunile în care modelul arată confuzie între diferite categorii. Aceste clusterizări care se suprapun dezvăluie punctele exacte în care judecata umană expertă poate deveni cea mai valoroasă.
Metodologia se concentrează în mod explicit pe perechi de exemple care se află cel mai aproape, dar poartă etichete diferite. Aceste cazuri limită reprezintă exact scenariile în care expertiza umană contează cel mai mult. Prin concentrarea eforturilor de etichetare expertă pe aceste exemple confuze, sistemul obține câștiguri remarcabile de eficiență.
Calitate peste cantitate
Cercetarea dezvăluie o constatare cheie cu privire la calitatea datelor care contestă o presupunere comună în inteligența artificială. Ea demonstrează că etichetele expert, cu fidelitatea lor ridicată, depășesc constant etichetele crowdsourcete la scară largă. Ei au măsurat acest lucru folosind Cohen’s Kappa, un instrument statistic care evaluează cât de bine predicțiile modelului se aliniază cu opiniile experților, dincolo de ceea ce s-ar întâmpla din întâmplare. În experimentele Google, anotatorii experți au obținut scoruri Cohen’s Kappa peste 0,8, depășind semnificativ ceea ce oferă, de obicei, crowdsourcingul.
Această coerență mai ridicată permite modelului să învețe eficient din mult mai puține exemple. În testele cu Gemini Nano-1 și Nano-2, modelele au egalat sau au depășit alinierea expertă folosind doar 250-450 de exemple selectate cu atenție, în comparație cu aproximativ 100.000 de etichete crowdsourcete aleatorii. Acesta este o reducere de trei până la patru ordine de mărime. Cu toate acestea, beneficiile nu se limitează numai la utilizarea a mai puține date. Modelele antrenate cu această abordare adesea depășesc pe cele antrenate cu metodele tradiționale. Pentru sarcini complexe și modele mai mari, îmbunătățirile de performanță au atins 55-65% față de linia de bază, ceea ce arată o aliniere mai substanțială și mai fiabilă cu experții în politici.
De ce această descoperire contează acum
Acest progres vine la un moment critic pentru industria inteligenței artificiale. Pe măsură ce modelele devin mai mari și mai sofisticate, abordarea tradițională de a scala datele de antrenare a devenit din ce în ce mai nesustenabilă. Costul mediului al antrenării modelelor masive continuă să crească, iar barierele economice pentru intrare rămân ridicate pentru multe organizații.
Metoda Google abordează multiple provocări ale industriei în același timp. Reducerea dramatică a costurilor de etichetare face dezvoltarea inteligenței artificiale mai accesibilă pentru organizații mai mici și echipe de cercetare. Ciclurile de iterare mai rapide permit adaptarea rapidă la cerințele în schimbare, esențială în domenii dinamice precum moderarea conținutului sau securitatea cibernetică.
Abordarea are, de asemenea, implicații mai largi pentru siguranța și fiabilitatea inteligenței artificiale. Prin concentrarea asupra cazurilor în care modelele sunt cel mai nesigure, metoda identifică în mod natural modurile posibile de eșec și cazurile limită. Acest proces creează sisteme mai robuste care înțeleg mai bine limitele lor.
Implicațiile mai largi pentru dezvoltarea inteligenței artificiale
Acest progres sugerează că putem intra într-o nouă fază a dezvoltării inteligenței artificiale în care eficiența contează mai mult decât scala. Abordarea tradițională “mai mare este mai bine” pentru datele de antrenare poate ceda locul unor metode mai sofisticate care prioritizează calitatea datelor și selecția strategică.
Implicațiile de mediu sunt semnificative. Antrenarea modelelor de inteligență artificială la scară largă necesită în prezent resurse computaționale și consum de energie uriașe. Dacă se poate obține o performanță similară cu mult mai puține date, amprenta de carbon a dezvoltării inteligenței artificiale ar putea scădea substanțial.
Efectul de democratizare ar putea fi la fel de important. Echipele de cercetare mai mici și organizațiile care nu au putut anterior să suporte eforturile de colectare a datelor la scară largă au acum o cale către sisteme de inteligență artificială competitive. Acest progres ar putea accelera inovația și crea perspective mai diverse în dezvoltarea inteligenței artificiale.
Limitări și considerații
În ciuda rezultatelor sale promițătoare, metodologia se confruntă cu mai multe provocări practice. Cerința pentru anotatori experți cu scoruri Cohen’s Kappa peste 0,8 poate limita aplicabilitatea în domenii lipsite de expertiză suficientă sau criterii de evaluare clare. Cercetarea se concentrează în primul rând pe sarcini de clasificare și aplicații de siguranță a conținutului. Rămâne de văzut dacă aceleași îmbunătățiri dramatice se aplică și altor tipuri de sarcini de inteligență artificială, cum ar fi generarea limbajului sau raționamentul.
Natura iterativă a învățării active introduce, de asemenea, complexitate în comparație cu abordările tradiționale de procesare în lot. Organizațiile trebuie să dezvolte fluxuri de lucru și infrastructură noi pentru a sprijini ciclurile de întrebare-răspuns care permit îmbunătățirea continuă a modelului.
Cercetările viitoare vor explora probabil abordări automate pentru menținerea calității etichetării la nivel expert și dezvoltarea de adaptări specifice domeniului ale metodologiei de bază. Integrarea principiilor de învățare activă cu alte tehnici de eficiență, cum ar fi reglarea fină eficientă a parametrilor, ar putea oferi câștiguri suplimentare de performanță.
Concluzia
Cercetarea Google arată că datele țintite și de înaltă calitate pot fi mai eficiente decât seturile de date masive. Prin concentrarea etichetării numai pe exemplele cele mai valoroase, ei au redus necesitățile de antrenare de până la 10.000 de ori, îmbunătățind în același timp performanța. Această abordare reduce costurile, accelerează dezvoltarea, reduce impactul asupra mediului și face inteligența artificială avansată mai accesibilă. Marchează o schimbare semnificativă către o dezvoltare a inteligenței artificiale eficientă și durabilă.












