Treffer: Image-based programming language recognition

Title:
Image-based programming language recognition
Contributors:
Gabbrielli, Maurizio, Zacchiroli, Stefano
Publisher Information:
Alma Mater Studiorum - Università di Bologna
Publication Year:
2020
Collection:
Università di Bologna: AMS Tesi di Laurea (Alm@DL)
Document Type:
Dissertation master thesis
File Description:
application/pdf
Language:
Italian
Relation:
https://amslaurea.unibo.it/id/eprint/22208/1/thesis_850838.pdf; Lategano, Antonio (2020) Image-based programming language recognition. [Laurea magistrale], Università di Bologna, Corso di Studio in Informatica [LM-DM270] , Documento ad accesso riservato.
Rights:
Free to read
Accession Number:
edsbas.780B29F
Database:
BASE

Weitere Informationen

Nel presente lavoro di tesi viene affrontato per la prima volta il problema della classificazione dei linguaggi di programmazione mediante approcci image-based. Abbiamo utilizzato alcune Convolutional Neural Network pre-addestrate su task di classificazione di immagini, adattandole alla classificazione di immagini contenenti porzioni di codice sorgente scritto in 149 diversi linguaggi di programmazione. I nostri risultati hanno dimostrato che tali modelli riescono ad apprendere, con buone prestazioni, le feature lessicali presenti nel testo. Aggiungendo del rumore, tramite modifica dei caratteri presenti nelle immagini, siamo riusciti a comprendere quali fossero i caratteri che meglio permettevano ai modelli di discriminare tra una una classe e l’altra. Il risultato, confermato tramite l’utilizzo di tecniche di visualizzazione come la Class Activation Mapping, è che la rete riesce ad apprendere delle feature lessicali di basso livello concentrandosi in particolare sui simboli tipici di ogni linguaggio di programmazione (come punteggiatura e parentesi), piuttosto che sui caratteri alfanumerici.