Lideri de opinie
Cum putem utiliza învățarea profundă cu date mici? – Lideri de gândire

Când vine vorba de a ține pasul cu tendințele emergente de securitate cibernetică, procesul de a rămâne la curent cu orice dezvoltări recente poate deveni destul de greoi, deoarece există multe știri de urmărit. În zilele noastre, însă, situația s-a schimbat dramatic, deoarece domeniile securității cibernetice par să se învârtă în jurul a două cuvinte – învățarea profundă.
Deși am fost inițial luați prin surprindere de acoperirea masivă pe care a primit-o învățarea profundă, a devenit rapid evident că zarva generată de învățarea profundă a fost bine meritată. Într-un mod similar cu creierul uman, învățarea profundă permite unui model de inteligență artificială să obțină rezultate extrem de precise, prin executarea directă a sarcinilor din text, imagini și semnale audio.
Până în acest punct, se credea în general că învățarea profundă se bazează pe un set enorm de date, similar cu magnitudinea datelor stocate de giganții din Valea Siliconului, Google și Facebook, pentru a rezolva cele mai complicate probleme din cadrul unei organizații. În contradicție cu credința populară, însă, întreprinderile pot valorifica puterea învățării profunde, chiar și cu acces la un bazin de date limitat.
În încercarea de a ajuta cititorii noștri cu cunoștințele necesare pentru a dota organizația lor cu învățarea profundă, am compilat un articol care se adâncește (fără intenție) în unele dintre modurile în care întreprinderile pot utiliza beneficiile învățării profunde, în ciuda faptului că au acces la date limitate.
Înainte de a putea intra în esența articolului, ne place să facem o sugestie mică, dar extrem de esențială – începeți simplu. Înainte de a formula rețele neuronale complexe suficient de mult pentru a apărea într-un film științifico-fantastic, începeți prin a experimenta cu câteva modele simple și convenționale, (de exemplu, pădurea aleatoare) pentru a vă obișnui cu software-ul.
Cu aceasta spusă, să intrăm direct în unele dintre modurile în care întreprinderile pot încorpora tehnologia de învățare profundă, având acces la date limitate.
#1 – Refinarea modelului de bază:
După cum am menționat deja mai sus, primul pas pe care întreprinderile trebuie să îl facă după ce au formulat un model de bază de învățare profundă simplu este să îl refinențeze pentru problema specifică în cauză.
Refinențarea unui model de bază sună mult mai greu pe hârtie decât este în realitate. Ideea fundamentală din spatele refinerii unui set de date mari pentru a se potrivi nevoilor specifice ale unei întreprinderi este simplă – luați un set de date mari care arată asemănător cu domeniul în care funcționați și apoi refinențați detaliile setului de date original cu datele dvs. limitate.
În ceea ce privește obținerea setului de date mari, proprietarii de întreprinderi pot să se bazeze pe ImageNet, care oferă, de asemenea, o soluție ușoară pentru orice problemă de clasificare a imaginilor. Setul de date găzduit de ImageNet oferă organizațiilor acces la milioane de imagini, care sunt împărțite în multiple clase de imagini, ceea ce poate fi util pentru întreprinderi dintr-o varietate de domenii, incluzând, dar nu limitându-se la imagini cu animale, etc.
Dacă procesul de refinențare a unui model preantrenat pentru a se potrivi nevoilor specifice ale organizației dvs. încă pare prea multă muncă pentru dvs., vă recomandăm să căutați ajutor pe internet, deoarece o simplă căutare Google vă va oferi sute de tutoriale despre cum să refinențați un set de date.
#2 – Colectați mai multe date:
Deși al doilea punct de pe lista noastră poate părea redundant pentru unii dintre cititorii noștri mai cinici, faptul rămâne – atunci când vine vorba de învățarea profundă, cu cât setul dvs. de date este mai mare, cu atât sunteți mai probabil să obțineți rezultate mai precise.
Deși esența acestui articol constă în a oferi întreprinderilor cu un set de date limitate, am întâlnit adesea prea mulți “șefi” care tratează investiția în colectarea de date ca și cum ar fi un păcat capital.
Este prea des întâlnit faptul că afacerile tind să ignore beneficiile oferite de învățarea profundă, pur și simplu pentru că sunt reticente să investească timp și efort în colectarea de date. Dacă întreprinderea dvs. este nesigură cu privire la cantitatea de date care trebuie colectate, vă sugerez să trasați curbe de învățare, pe măsură ce datele suplimentare sunt integrate în model, și să observați schimbarea în performanța modelului.
În contradicție cu credința populară susținută de majoritatea CSO-urilor și CISO-urilor, uneori cel mai bun mod de a rezolva problemele este prin colectarea mai multor date relevante. Rolul CSO și CISO este extrem de important în acest caz, deoarece există întotdeauna o amenințare de atacuri cibernetice. S-a constatat că, în 2019, cheltuielile globale totale pentru securitatea cibernetică au ajuns la 103,1 miliarde de dolari, iar numărul continuă să crească. Pentru a pune aceasta în perspectivă, să considerăm un exemplu simplu – imaginați-vă că încercați să clasificați diamante rare, dar aveți acces la un set de date foarte limitat. Ca soluție cea mai evidentă la problema, în loc de a vă bucura de modelul de bază, pur și simplu colectați mai multe date!
#3 – Augmentarea datelor:
Deși primele două puncte pe care le-am discutat mai sus sunt ambele foarte eficiente în oferirea unei soluții simple pentru majoritatea problemelor care înconjoară implementarea învățării profunde în întreprinderi cu un set de date mic, ele se bazează puternic pe un anumit nivel de noroc pentru a face treaba.
Dacă nu aveți succes cu refinențarea unui set de date preexistent, vă recomandăm să încercați augmentarea datelor. Modul în care se realizează augmentarea datelor este simplu. Prin procesul de augmentare a datelor, setul de date de intrare este modificat sau augmentat într-un mod care oferă un nou output, fără a schimba în realitate valoarea etichetei.
Pentru a pune ideea de augmentare a datelor în perspectivă pentru cititorii noștri, să considerăm o imagine a unui câine. Când este rotită, privitorul imaginii va putea încă să spună că este o imagine a unui câine. Acesta este exact ceea ce își propune augmentarea datelor să realizeze, în comparație cu o imagine rotită a unei șosele, care schimbă unghiul de înălțime și lasă mult spațiu pentru algoritmul de învățare profundă să ajungă la o concluzie greșită și să înfrângă scopul implementării învățării profunde.
Când vine vorba de rezolvarea problemelor legate de clasificarea imaginilor, augmentarea datelor servește ca un jucător cheie în domeniu și găzduiește o varietate de tehnici de augmentare a datelor care ajută modelul de învățare profundă să obțină o înțelegere profundă a clasificărilor diferite de imagini.
În plus, atunci când vine vorba de augmentarea datelor – posibilitățile sunt virtual nelimitate. Întreprinderile pot implementa augmentarea datelor într-o varietate de moduri, care includ NLP și experimentarea GAN-urilor, ceea ce permite algoritmului să genereze date noi.
#4 – Implementarea efectului de ansamblu:
Tehnologia din spatele învățării profunde dictează că rețeaua este construită pe multiple straturi. Cu toate acestea, în contradicție cu credința populară susținută de mulți, mai degrabă decât a vedea fiecare strat ca o “ierarhie în creștere” a caracteristicilor, stratul final servește scopul de a oferi un mecanism de ansamblu.
Credința că întreprinderile cu acces la un set de date limitat ar trebui să opteze pentru construirea rețelelor lor adânc a fost, de asemenea, împărtășită într-un document NIPs, care a reflectat credința pe care am exprimat-o mai sus. Întreprinderile cu date mici pot manipula ușor efectul de ansamblu în favoarea lor, pur și simplu construind rețelele lor de învățare profundă adânc, prin refinențare sau prin alte alternative.
#5 – Incorporarea autoencoderelor:
Deși al cincilea punct pe care l-am luat în considerare a primit doar un nivel relativ de succes – suntem încă de acord cu utilizarea autoencoderelor pentru a preantrena o rețea și a o initializa corect.
Una dintre cele mai mari motive, în afara atacurilor cibernetice, pentru care întreprinderile nu reușesc să treacă peste primele obstacole ale integrării învățării profunde este din cauza unei inițializări proaste, și a multor capcane ale acesteia. Preantrenarea nesupravegheată duce adesea la o execuție proastă sau incorectă a tehnologiei de învățare profundă, ceea ce este unde autoencoderelor pot străluci.
Notiunea fundamentală din spatele unei rețele neuronale dictează crearea unei rețele neuronale care prezice natura setului de date de intrare. Dacă sunteți nesigur cu privire la modul de utilizare a unui autoencoder, există numeroase tutoriale online care oferă instrucțiuni clare.
Pentru a concluziona:
La sfârșitul articolului, ne place să reimburzăm ceea ce am spus pe parcursul articolului, cu o adăugare – incorporarea cunoștințelor specifice domeniului în procesul de învățare! Nu numai că incorporarea insight-urilor valoroase accelerează procesul de învățare, dar permite, de asemenea, tehnologiei de învățare profundă să producă rezultate mai bune și mai precise.












