AGI și viitorul AI
Este GPT-4 un salt înainte spre atingerea inteligenței artificiale generale?
Microsoft (MSFT ) a publicat recent un articol de cercetare intitulat: Scântei de inteligență artificială generală: Experimente timpurii cu GPT-4. Așa cum este descris de Microsoft:
Acest articol prezintă investigația noastră asupra unei versiuni timpurii a GPT-4, când era încă în dezvoltare activă de către OpenAI. Susținem că (această versiune timpurie a) GPT-4 face parte dintr-un nou grup de modele de limbaj mare (împreună cu ChatGPT și PaLM de la Google , de exemplu) care prezintă o inteligență mai generală decât modelele de inteligență artificială anterioare.
În acest articol, există dovezi concludente care demonstrează că GPT-4 merge mult dincolo de memorizare și că are o înțelegere profundă și flexibilă a conceptelor, abilităților și domeniilor. De fapt, capacitatea sa de a generaliza depășește cu mult cea a oricărui om viu astăzi.
În timp ce am discutat anterior despre beneficiile inteligenței artificiale generale, ar trebui să rezumăm rapid consensul general cu privire la ceea ce este un sistem de inteligență artificială generală. În esență, un AGI este un tip avansat de inteligență artificială care poate generaliza în multiple domenii și nu este îngust în scop. Exemple de inteligență artificială îngustă includ un vehicul autonom, un chatbot, un robot de șah sau orice alt tip de inteligență artificială proiectată pentru un singur scop.
Un AGI, în schimb, ar putea să alterneze flexibil între oricare dintre acestea sau orice alt domeniu de expertiză. Este o inteligență artificială care ar putea să profite de algoritmi emergenți, cum ar fi învățarea prin transfer, și învățarea evolutivă, și să exploateze algoritmi legacy, cum ar fi învățarea adâncă de întărire.
Descrierea de mai sus a AGI se potrivește experienței mele personale cu utilizarea GPT-4, precum și dovezilor prezentate în articolul de cercetare publicat de Microsoft.
Una dintre provocările prezentate în articol este ca GPT-4 să scrie o dovadă a infinității numerelor prime sub formă de poem.

Dacă analizăm cerințele pentru crearea unui astfel de poem, ne dăm seama că necesită raționament matematic, expresie poetică și generare de limbaj natural. Aceasta este o provocare care ar depăși capacitatea medie a majorității oamenilor.
Articolul a dorit să înțeleagă dacă GPT-4 producea conținut pe baza memorizării generale sau dacă înțelegea contextul și putea raționa. Când i s-a cerut să recreeze un poem în stilul lui Shakespeare, a fost capabil să o facă. Acest lucru necesită un nivel multifacetic de înțelegere care depășește capacitatea generală a populației și include teoria minții și geniul matematic.
Cum se calculează inteligența GPT-4?
Întrebarea devine atunci cum putem măsura inteligența unui model de limbaj mare? Și este GPT-4 capabil să arate comportamente de învățare adevărată sau doar memorizare?
Metoda actuală de testare a unui sistem de inteligență artificială constă în evaluarea sistemului pe o serie de seturi de date de referință standard, și să ne asigurăm că acestea sunt independente de datele de antrenament și că acoperă o gamă de sarcini și domenii. Acest tip de testare este aproape imposibil datorită cantității uriașe de date pe care GPT-4 a fost antrenat.
Articolul discută despre generarea de sarcini și întrebări noi și dificile care demonstrează în mod convingător că GPT-4 merge mult dincolo de memorizare și că are o înțelegere profundă și flexibilă a conceptelor, abilităților și domeniilor.
Când vine vorba de inteligență, GPT-4 poate genera povestiri scurte, scenarii și poate calcula formulele cele mai complicate.
GPT-4 este, de asemenea, capabil să programeze la un nivel foarte înalt, atât în ceea ce privește scrierea de cod din instrucțiuni, cât și înțelegerea codului existent. GPT-4 poate gestiona o gamă largă de sarcini de programare, de la provocări de cod la aplicații din lumea reală, de la asamblare de nivel scăzut la cadre de nivel înalt, de la structuri de date simple la programe complexe, cum ar fi jocuri. GPT-4 poate, de asemenea, să raționeze despre execuția codului, să simuleze efectele instrucțiunilor și să explice rezultatele în limbaj natural. GPT-4 poate chiar să execute pseudocod,
GPT-4 poate oferi răspunsuri raționale la aproape orice provocare dată. De fapt, inteligența sa este aproape invincibilă în complexitatea sa.
Limitări ale GPT-4
Articolul continuă apoi să descrie cum au investigat răspunsurile și comportamentele GPT-4, pentru a verifica coerența, corectitudinea și consistența sa, și pentru a descoperi limitările și prejudecățile sale.
Cea mai evidentă limitare este tendința sa de a halucina. Iată un exemplu de halucinație care este prezentat în articol, unde GPT-4 a fost sigur de răspunsul său, care era complet fals.

Se pare că chiar și GPT-4 înțelege această limitare actuală cu halucinații, deoarece acesta a fost răspunsul pe care l-a dat când i-am cerut să-mi spună ce este o halucinație GPT:
O halucinație GPT se referă la un fenomen în care un model de transformare generativă (GPT) produce un răspuns care nu se bazează pe informații factuale sau nu este coerent cu contextul furnizat. Aceste halucinații apar atunci când modelul generează text care poate părea plauzibil, dar este de fapt incorect, înșelător sau nonsens.
Cu alte cuvinte, când antrenezi un model de limbaj mare pe datele lumii, cum poți evita ca sistemul să învețe date incorecte? Un model de limbaj mare care învață și regurgitează informații false și teorii ale conspirației ar putea fi una dintre cele mai mari capcane și amenințări cu care se confruntă omenirea în adoptarea pe scară largă a modelelor de limbaj mare. Acest lucru ar putea fi una dintre cele mai mari amenințări din partea inteligenței artificiale generale, una care este surprinzător de omisă atunci când se discută despre pericolele inteligenței artificiale generale.
Dovezi ale inteligenței GPT-4
Articolul ilustrează că nu a contat ce tip de provocări complexe au fost direcționate către GPT-4, GPT-4 a depășit așteptările. Așa cum se afirmă în articol:
Stăpânirea sa fără precedent a limbajului natural. Nu numai că poate genera text fluent și coerent, dar poate, de asemenea, să înțeleagă și să manipuleze limbajul în diverse moduri, cum ar fi rezumarea, traducerea sau răspunsul la o gamă extrem de largă de întrebări. Mai mult, prin traducere, nu ne referim doar la traducerea între limbi naturale diferite, ci și la traducerea în ton și stil, precum și la traducerea între domenii, cum ar fi medicină, drept, contabilitate, programare, muzică și multe altele.
Au fost efectuate recenzii tehnice simulate pentru GPT-4, care a trecut cu succes, ceea ce înseamnă că, în acest context, dacă ar fi fost un om pe celălalt capăt al conversației, ar fi fost angajat imediat ca inginer de software. Un test preliminar similar al competenței GPT-4 la examenul de barou multistatal a arătat o acuratețe de peste 70%. Acest lucru înseamnă că, în viitor, putem automatiza multe dintre sarcinile care sunt în prezent atribuite avocaților. De fapt, există unele start-up-uri care lucrează la crearea de avocați-roboți utilizând GPT-4.
Producerea de cunoștințe noi
Unul dintre argumentele din articol este că singura dovadă care lipsește pentru a demonstra niveluri adevărate de înțelegere este ca GPT-4 să producă cunoștințe noi, cum ar fi demonstrarea de teoreme matematice noi, o realizare care în prezent rămâne în afara modelelor de limbaj mare.
Apoi, acesta este Graalul inteligenței artificiale generale. Deși există pericole cu un AGI controlat de mâini greșite, beneficiile unui AGI care poate analiza rapid toate datele istorice pentru a descoperi teoreme, remedii și tratamente noi sunt aproape infinite.
Un AGI ar putea fi legătura lipsă pentru a găsi remedii pentru boli genetice rare care în prezent lipsesc fonduri private, pentru a vindeca cancerul o dată pentru totdeauna și pentru a maximiza eficiența energiei regenerabile pentru a elimina dependența noastră de energie nesustenabilă. De fapt, ar putea rezolva orice problemă consecventă care este introdusă în sistemul AGI. Acesta este ceea ce înțeleg Sam Altman și echipa de la OpenAI, un AGI este, într-adevăr, ultima invenție care este necesară pentru a rezolva cele mai multe probleme și pentru a beneficia omenirii.
Desigur, acest lucru nu rezolvă problema butonului nuclear al controlului asupra AGI și al intențiilor sale. Indiferent de acest lucru, acest articol face o treabă fenomenală în a argumenta că GPT-4 este un salt înainte spre atingerea visului cercetătorilor de inteligență artificială de la 1956, când a fost lansat pentru prima dată proiectul de cercetare de vară Dartmouth pe inteligență artificială.
În timp ce este discutabil dacă GPT-4 este un AGI, se poate argumenta cu ușurință că, pentru prima dată în istoria omenirii, este un sistem de inteligență artificială care poate trece testul Turing.












