Modele și platforme AI

Cercetători în domeniul inteligenței artificiale dezvoltă o rețea neuronală explicabilă pentru a descoperi regulile genomice

mm
Adaugă Unite.AI la sursele tale preferate pe Google

O echipă de cercetători a creat recent o rețea neuronală explicabilă menită să ajute biologii să descopere regulile misterioase care guvernează codul genomului uman. Echipa de cercetare a instruit o rețea neuronală pe hărți de interacțiuni proteine-DNA, permițând inteligenței artificiale să descopere cum anumite secvențe de DNA reglementează anumite gene. Cercetătorii au făcut, de asemenea, modelul explicabil, astfel încât au putut analiza concluziile modelului și determina cum motivele de secvențe reglementează genele.

Una dintre marile mistere în biologie este codul regulamentar al genomului. Se știe că DNA este alcătuit din patru baze de nucleotide – Adenină, Guanină, Timină și Citozină – dar nu se știe cum aceste perechi de baze sunt utilizate pentru a reglementa activitatea. Cele patru baze de nucleotide codifică instrucțiunile pentru construirea proteinelor, dar ele controlează și unde și cum sunt exprimate genele, (cum produc proteine într-un organism). Anumite combinații și aranjamente ale bazelor creează secțiuni de cod regulamentar care se leagă de segmente de DNA, și nu se știe ce sunt aceste combinații.

O echipă interdisciplinară de oameni de știință din domeniul informaticii și biologiei a încercat să rezolve acest mister prin crearea unei rețele neuronale explicabile. Echipa de cercetare a creat o rețea neuronală pe care au numit-o “Rețea de perechi de baze” sau “BPNet”. Modelul utilizat de BPNet pentru a genera predicții poate fi interpretat pentru a identifica codurile regulamentare. Acest lucru a fost realizat prin predicția modului în care proteinele numite factori de transcriere se leagă de secvențele de DNA.

Cercetătorii au efectuat o varietate de experimente și au realizat modelări computerizate cuprinzătoare pentru a determina cum factorii de transcriere și DNA sunt legați împreună, dezvoltând o hartă detaliată până la nivelul individual de baze de nucleotide. Reprezentările detaliate ale factorilor de transcriere-DNA au permis cercetătorilor să creeze unelte capabile să interpreteze atât modelele critice de secvențe de DNA, cât și regulile care funcționează ca cod regulamentar.

Julia Zeitlinger, biolog și cercetător computațional la Universitatea Stanford, a explicat că rezultatele obținute din rețeaua neuronală explicabilă s-au potrivit cu rezultatele experimentale existente, dar au conținut și insight-uri surprinzătoare cu privire la codul regulamentar al genomului. De exemplu, modelul de inteligență artificială a permis echipei de cercetare să descopere o regulă care influențează modul în care un factor de transcriere numit Nanog funcționează. Atunci când multiple instanțe ale motivului Nanog sunt prezente pe aceeași parte a unei duble helice de DNA, ele se leagă cooperativ de DNA. Așa cum a explicat Zeitlinger prin ScienceDaily:

“A existat o lungă serie de dovezi experimentale că o astfel de periodicitate a motivului uneori există în codul regulamentar. Cu toate acestea, circumstanțele exacte au fost evazive, și Nanog nu a fost un suspect. Descoperirea faptului că Nanog are un astfel de model, și vederea unor detalii suplimentare ale interacțiunilor sale, a fost surprinzătoare, deoarece nu am căutat în mod specific acest model.”

Articolul de cercetare recent publicat nu este primul studiu care utilizează inteligența artificială pentru a analiza DNA, dar este probabil primul studiu care deschide “cutia neagră” a inteligenței artificiale pentru a determina care secvențe de DNA reglementează genele în genom. Rețelele neuronale sunt excelente la găsirea de modele în date, dar insight-urile lor sunt greu de extras din modelele pe care le creează. Prin crearea unei metode de analiză a caracteristicilor pe care modelul le consideră importante pentru predicția regulilor genomice, cercetătorii au putut antrena modele mai nuanțate care duc la descoperiri noi.

Arhitectura BPNet este similară cu rețelele utilizate pentru a recunoaște fețe în imagini. Atunci când sistemele de viziune computerizată recunosc fețe în imagini, rețeaua începe prin detectarea marginilor și apoi leagă aceste margini împreună. Diferența constă în faptul că BPNet învață din secvențe de DNA, detectând motive de secvențe și unind aceste motive în reguli de ordine superioară care pot fi utilizate pentru a prevedea legarea datelor la rezoluția bazei.

După ce modelul a atins un prag de acuratețe ridicat, modelele învățate de model sunt urmărite înapoi la secvențele de intrare originale, dezvăluind motivele de secvențe. În final, modelul este furnizat cu interogări sistematice de secvențe de DNA, permițând cercetătorilor să înțeleagă regulile prin care motivele de secvențe se combină și funcționează. Conform lui Zeitlinger, modelul este capabil să prevadă mult mai multe secvențe decât cercetătorii ar putea spera să le testeze într-un mod tradițional, experimental. În plus, previziunea rezultatului anomaliilor experimentale a permis cercetătorilor să identifice care experimente au fost cele mai informative atunci când au validat modelul.

Blogger și programator cu specializări în Machine Learning și Deep Learning subiecte. Daniel speră să ajute pe alții să folosească puterea inteligenței artificiale pentru binele social.