Data mining nella linguistica dei corpora
Nell’ambito del suo progetto di dottorato, “Data mining nella linguistica dei corpora”, Jennifer-Carmen Frey mira a collegare i campi delle scienze informatiche e delle scienze linguistiche, esplorando i recenti metodi di data-mining e il loro valore per la ricerca sui corpora. Nel quadro di un caso di studio di natura esplorativa, i metodi di analisi dei dati di ultima generazione basati sull’apprendimento automatico (machine learning) saranno adattati alle esigenze della linguistica dei corpora e poi valutati tramite implementazioni prototipiche sulla ricerca corpora esistente. L’approccio mira principalmente ad appurare se i metodi di data-mining sono in grado di a) generare (e quindi verificare) i risultati di ricerca finora ottenuti e b) guidare il linguista verso ulteriori modelli, interessanti dal punto di vista linguistico, che emergono dai dati. I risultati del lavoro, la valutazione e la discussione sulle potenzialità e sui limiti delle tecniche di data mining corpus-driven, così come l’offerta delle implementazioni in forma di plug-in ready-to-use per i software più diffusi di analisi dei corpora, mostreranno se e come le tecniche di data mining possono essere utili alla ricerca nell’ambito della linguistica dei corpora generale.
- Project duration: -
- Project status:
- Institute: Istituto di linguistica applicata
Discover
Scopri esperte ed esperti, pubblicazioni e temi di ricerca collegati.


