Home » Articole » Articole » Afaceri » Știința datelor (Data Science) » Învățarea automată (Machine learning) » Învățarea și contextul reprezentărilor în învățarea automată și extragerea cunoștințelor (MAKE)

Învățarea și contextul reprezentărilor în învățarea automată și extragerea cunoștințelor (MAKE)

Performanța oricărui algoritm de învățare automată (ML) depinde de alegerea reprezentărilor datelor. Prin urmare, aceste reprezentări ale datelor, cunoscute și sub numele de caracteristici, sunt esențiale pentru învățare și înțelegere, prin urmare, mult efort în ML se depune în proiectarea conductelor de preprocesare și în transformările și mapările datelor care au ca rezultat o reprezentare respectivă ce susține ML eficient.

Algoritmii de învățare actuali au încă o slăbiciune enormă: nu sunt capabili să extragă cunoștințele discriminative din date. Prin urmare, este de o importanță capitală extinderea aplicabilității universale a algoritmilor de învățare, prin urmare, să îi facem mai puțin dependenți de ingineria caracteristicilor (create manual).

Bengio, Courville și Vincent (2013) [30] susțin că acest lucru poate fi realizat numai dacă algoritmii pot învăța să identifice și să separe factorii exploratori subiacenți deja existenți printre datele de nivel scăzut. Aceasta implică faptul că este necesar un algoritm cu adevărat inteligent pentru a înțelege contextul și pentru a putea discrimina între caracteristicile relevante și cele irelevante – similar cu ceea ce putem face noi, oamenii. „Ce este interesant?” și „Ce este relevant?” sunt întrebări dificile și, atâta timp cât nu putem atinge acest obiectiv măreț cu abordări automate, trebuie să dezvoltăm algoritmi care pot fi aplicați de un expert în domeniu.

Un astfel de expert este probabil conștient de ceea ce este interesant și relevant în domeniul său, putând astfel proiecta caracteristici mai adecvat decât un inginer de învățare automată, care în mare parte nu este expert în domeniu. Acest lucru necesită un nou tip de utilizabilitate a algoritmilor [31].

Revenind la perspectiva noastră probabilistică, aceasta ar însemna că învățarea caracteristicilor din date poate fi văzută ca recuperarea unui set parcimonios de variabile aleatorii latente (adică, conform teoremei lui Occams, vezi [32] pentru o discuție critică), reprezentând o distribuție peste datele observate pentru a exprima un model probabilistic p(x,h) peste spațiul comun al variabilelor latente, h, și al datelor observate x. De asemenea, această abordare se încadrează bine în perspectiva științei cognitive [33].

Referințe

  1.    Bengio, Y.; Courville, A.; Vincent, P. Representation learning: A review and new perspectives. IEEE Trans. Pattern Anal. Mach. Intell. 2013, 35,1798-1828, doi:10.1109/TPAMI.2013.50.
  2.    Neumann, M.; Huang, S.; Marthaler, D.E.; Kersting, K. pyGPs: A Python library for Gaussian process regression and classification. J. Mach. Learn. Res. 2015,16, 2611-2616.
  3.    Domingos, P. The Role of Occam’s Razor in Knowledge Discovery. Data Min. Knowl. Discov. 1999, 3,409-425, doi:10.1023/a:1009868929893.
  4.    Wilson, A.G.; Dann, C.; Lucas, C.G.; Xing, E.P. The Human Kernel. arXiv 2015, arXiv:1510.07389.

 

Sursa: Holzinger, A. Introduction to MAchine Learning & Knowledge Extraction (MAKE). Mach. Learn. Knowl. Extr. 2019, 1, 1-20. https://doi.org/10.3390/make1010001. Licența CC BY 4.0. Traducere și adaptare © 2024 Nicolae Sfetcu

IT & C, Volumul 2, Numărul 3, Septembrie 2023
IT & C, Volumul 2, Numărul 3, Septembrie 2023 – Rezumate

Revista IT & C este o publicație trimestrială din domeniile tehnologiei informației și comunicații, și domenii conexe de studiu și practică. Cuprins: EDITORIAL Provocări în inteligența artificială TEHNOLOGIA INFORMAȚIEI Blockchain Design and Modelling TELECOMUNICAȚII Arhitectura de bază a rețelelor 5G … Citeşte mai mult

Nu a fost votat 0.00 lei Adaugă în coș
IT & C, Volumul 3, Numărul 2, Iunie 2024
IT & C, Volumul 3, Numărul 2, Iunie 2024

Revista IT & C este o publicație trimestrială din domeniile tehnologiei informației și comunicații, și domenii conexe de studiu și practică. Cuprins: EDITORIAL / EDITORIAL Levering Data Science in the Detection of Advanced Persistent Threats Utilizarea științei datelor în detectarea … Citeşte mai mult

Nu a fost votat 9.14 lei Selectează opțiunile Acest produs are mai multe variații. Opțiunile pot fi alese în pagina produsului.
Prima răscruce
Prima răscruce

Plecă cu gândul în trecut, încercând să identifice prima răscruce. O găsi. Era departe în urmă cu câteva decenii. Atunci pe când era la Șimleul Silvaniei a început s-o roadă primul vierme. Se numea „Setea de Putere”. Aceasta și-a adus … Citeşte mai mult

Nu a fost votat Citește mai mult


Descoperă mai multe la MultiMedia

Abonează-te ca să primești ultimele articole prin email.

Lasă un răspuns

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *