Lideri de opinie

Ce ar trebui să știe fiecare specialist în știința datelor despre Transformatorii de Grafuri și impactul lor asupra datelor structurate

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Am co-creat Rețelele Neuronale de Grafuri în timp ce eram la Stanford. Am recunoscut de la început că această tehnologie era incredibil de puternică. Fiecare punct de date, fiecare observație, fiecare piesă de cunoaștere nu există în izolare; face parte dintr-un graf conectat la alte piese de cunoaștere. Important, majoritatea datelor de afaceri valoroase, adesea stocate sub formă de tabele în baze de date și depozite de date, pot fi reprezentate în mod natural sub formă de graf. Exploaterea acestei structuri relationale este cheia pentru a construi modele de inteligență artificială precise și non-halucinante.

Rețelele Neuronale de Grafuri (GNN) au introdus arhitecturi de transmitere a mesajelor care pot raționa peste grafuri care capturează conexiunile dintre piesele de cunoaștere.

Dar, la fel cum Transformatorii au transformat înțelegerea limbajului, o nouă clasă de modele, Transformatori de Grafuri, aduce beneficii similare datelor bazate pe grafuri. Aceste modele combină flexibilitatea mecanismelor de atenție cu priori structurali de graf pentru a modela relații complexe mai eficient decât predecesorii GNN.

De ce grafurile necesită mai mult decât transmiterea mesajelor

Rețelele Neuronale de Grafuri tradiționale (GNN) se bazează pe transmiterea mesajelor, un proces în care fiecare nod își actualizează starea internă prin agregarea informațiilor de la vecinii săi. Gândiți-vă la acest proces ca la un schimb de rezumate între noduri, apoi utilizarea acestor rezumate pentru a rafina propria înțelegere. Pe multiple straturi, acest lucru permite informațiilor să se propage prin graf.

În timp ce este puternic pentru învățarea modelelor locale, transmiterea mesajelor are limitări importante:

  • Suprimarea excesivă: Pe măsură ce informațiile sunt agregate pe multiple salturi, pot deveni comprimate, pierzând detalii semnificative. Acest lucru este deosebit de problematic în GNN adânci.
  • Context limitat: Transmiterea standard a mesajelor nu poate captura ușor dependențele pe termen lung fără multiple straturi, ceea ce crește complexitatea și zgomotul.
  • Exprimabilitate: Multe structuri de grafuri nu pot fi diferențiate utilizând doar informații locale despre vecinătate, limitând performanța modelului în sarcini care necesită distincții structurale fine.

Aici intervin Transformatorii de Grafuri. Prin înlocuirea sau completarea transmiterii mesajelor cu mecanisme de atenție, aceștia permit fiecărui nod să se concentreze direct asupra altor noduri (chiar și a celor îndepărtate) pe baza importanței învățate. Rezultatul este reprezentări mai bogate, o scalabilitate mai bună și capacitatea de a raționa peste structuri complexe într-un mod mai flexibil.

De la GNN la Transformatori de Grafuri

Modelul original de Transformator, prezentat în articolul iconic, Attenția este tot ce ai nevoie, a fost proiectat pentru a modela relațiile dintre tokeni într-o secvență. Succesul său se datorează atenției de sine, un mecanism care permite fiecărui intrare să considere toate celelalte intrări, ponderate de relevanța învățată.

Transformatorii de Grafuri adaptează acest paradigma, permițând nodurilor să se concentreze nu numai asupra vecinilor, ci asupra oricărui nod din graf, fie prin atenție complet conectată, fie printr-o abordare hibridă care echilibrează semnalele globale și locale. Provocarea constă în introducerea unei noțiuni de structură într-un model proiectat pentru secvențe neordonate.

Încodări Poziționale Specifice Grafurilor

În contrast cu textul, grafurile nu au o ordine intrinsecă, făcând încodarea pozițională, care se referă la tehnici pentru injectarea informațiilor structurale sau a informațiilor bazate pe locație într-un model, non-trivială. Transformatorii de Grafuri abordează acest lucru prin diverse metode:

  • Vectoare proprii ale Laplacianului: Derivate din matricea Laplacian a grafului, acestea oferă o încorporare spectrală care capturează structura globală.
  • Plimbări aleatoare: Capturează probabilitatea de a traversa de la un nod la altul pe parcursul mai multor salturi.
  • Încodări structurale: Includ metrice de distanță, grade de noduri sau tipuri de muchii.

Aceste încodări poziționale, fie spectrale, probabilistice sau structurale, oferă Transformatorilor de Grafuri o modalitate de a înțelege unde se află fiecare nod în cadrul grafului mai larg. Această conștientizare structurală este esențială pentru a permite mecanismelor de atenție să funcționeze în mod semnificativ peste date neregulate și neordonate, permițând în final modelului să captureze relații care ar fi invizibile pentru metodele locale mai simple.

Implementări și Aplicații în Lumea Reală

Introducerea Transformatorilor de Grafuri în producție necesită infrastructură care să poată scala la dimensiuni de date din lumea reală. Biblioteci precum PyTorch Geometric (PyG) fac acest lucru posibil. Construit pe PyTorch, PyG oferă un cadru modular pentru implementarea GNN și a Transformatorilor de Grafuri într-o gamă largă de aplicații, de la modelarea moleculelor la sistemele de recomandare. Aceasta suportă antrenamentul pe mini-loturi atât pentru grafuri mici, cât și pentru grafuri mari, cu suport pentru multi-GPU și torch.compile, făcându-le potrivite atât pentru fluxurile de lucru de cercetare, cât și pentru cele de întreprindere.

Aceste instrumente sunt deja utilizate într-o gamă largă de aplicații din lumea reală. În descoperirea de medicamente, Transformatorii de Grafuri ajută la predicția proprietăților moleculare prin modelarea interacțiunilor atomice sub formă de grafuri. În logistica și optimizarea lanțului de aprovizionare, acestea pot reprezenta și raționa peste rețele dinamice de transport, depozite și rute. Companiile de comerț electronic le utilizează pentru a îmbunătăți recomandările prin înțelegerea comportamentului de cumpărare și navigare a produselor sub formă de grafuri relationale. Și în securitatea cibernetică, modelele bazate pe grafuri sunt utilizate pentru a detecta anomalii prin analizarea modelelor de acces, topologiei rețelei și secvențelor de evenimente.

În fiecare dintre aceste contexte, capacitatea de a învăța din structuri complexe și interconectate, fără a se baza exclusiv pe caracteristici create manual, se dovedește a fi un avantaj major.

Considerații Tehnice

În ciuda potențialului lor, Transformatorii de Grafuri vin cu compromisuri reale de inginerie. Attenția de sine completă se scalează pătratic cu numărul de noduri, făcând eficiența memoriei și a calculului o preocupare de top, în special pentru grafuri mari sau dense. Multe grafuri din lumea reală au, de asemenea, muchii orientate, introducând asimetrii care complică modul în care informațiile structurale sunt încodate. Și în implementările practice, intrările rareori sunt uniforme: combinarea datelor structurate sub formă de graf cu text, serii de timp sau imagini cere alegeri arhitecturale atente și o prelucrare robustă a datelor.

Aceste provocări nu sunt insurmontabile, dar necesită o proiectare sistemului gândită, în special atunci când se face trecerea de la prototipuri de cercetare la modele gata de producție.

Ce Urmează: LLM Meet Grafuri

O direcție importantă de cercetare este integrarea modelelor de limbaj mare (LLM) cu structuri de grafuri. Aceste sisteme hibride utilizează LLM pentru a încoda contextul textual sau pentru a extrage entități, apoi pentru a ancora aceste informații într-un graf pentru raționament și luare a deciziilor.

În biologie, acest lucru a alimentat instrumente precum AlphaFold. În inteligența artificială de întreprindere, acesta permite sisteme de suport pentru clienți care combină documentația și grafurile comportamentale. Transformatorii de Grafuri joacă, de asemenea, un rol tot mai important în permiterea agenților de inteligență artificială să ia decizii mai inteligente și mai acționabile, permițându-le să raționeze peste reprezentări structurate ale stării și să prioritizeze interacțiunile dinamic. Această fuziune ajută agenții să înțeleagă mai bine relațiile ierarhice, să urmărească dependențele în timp și să-și adapteze comportamentul în medii complexe.

Domnul este încă în curs de dezvoltare, dar potențialul este semnificativ.

Concluzie

Transformatorii de Grafuri nu sunt doar următoarea iterație a GNN; ei reprezintă o convergență a atenției, structurii și scalabilității. Indiferent dacă lucrați în finanțe, științe ale vieții sau sisteme de recomandare, mesajul este clar: datele dvs. formează un graf, deci și modelele dvs. ar trebui să o facă.

Dr. Jure Leskovec este Șeful științific și co-fondator al Kumo, o companie de inteligență artificială predictivă de top. El este profesor de științe computaționale la Stanford, unde predă de peste 15 ani. Jure a co-creat Rețelele Neuronale Grafice și și-a dedicat cariera pentru a avansa modul în care IA învață din informațiile conectate. Anterior, el a ocupat funcția de Șef științific la Pinterest și a efectuat cercetări premiate la Yahoo și Microsoft.