← Indietro
EsameEsame completoTesto d’esame

20200131

Esame completo di Metodi per il ritrovamento dell'informazione per il corso di Informatica presso Università degli Studi di Bari Aldo Moro. Materiale proveniente dall’archivio storico Studwiz e classificato per la consultazione online.

Metodi per il ritrovamento dell'informazioneEsame completo

Informazioni sul documento

Cosa trovi in questo materiale

Esame completo di Metodi per il ritrovamento dell'informazione per il corso di Informatica presso Università degli Studi di Bari Aldo Moro. Materiale proveniente dall’archivio storico Studwiz e classificato per la consultazione online.

Qualità dell’importazione: il testo è stato estratto direttamente dal documento originale.

Contenuti estratti dal documento

Passaggi rappresentativi riconosciuti nelle diverse parti del materiale. Il testo completo resta presente nella pagina per la ricerca, mentre l’anteprima compatta rende più semplice la lettura.

Pagina 1

Prova scritta di METODI PER IL RITROVAMENTO DELL’INFORMAZIONE C.d.L. in Informatica - A.A. 2019-20 Docente: P. Lops - 31 Gennaio 2020 Nome e Cognome : ___________________________________________ Matricola : ___________________________________________ 1) Sia q una query che ha 6 documenti rilevanti nella collezione. Supponiamo che un algoritmo di ritrovamento applicato a q riporti il seguente ranking Rq: D1 D5 D3 D7 D9 D4 Supponiamo che D5, D7 e D4 siano documenti rilevanti per q a) Calcolare l’Average Precision per la query q, fornendo anche una descrizione della metrica (PUNTI 3) b) Riportare la curva di precision-recall per la query q, usando gli 11 livelli standard di recall (PUNTI 3) c) Supponendo di avere dei giudizi di rilevanza non binari, e assume ndo che D5 abbia un grado di rilevanza pari a 3, mentre D7 e D4 abbiano un grado di rilevanza pari a 1, calcolare il valore del DCG (Discounted Cumulative Gain) per q, fornendo anche una breve descrizione della metrica. (PUNTI 4) 2) Siano dati l’insieme delle categorie C = {c1, c2} e una collezione di 150 documenti definiti sul vocabolario V = {T1,T2,T3,T4,T5}. a) Costruire un classificatore bayesiano per C, addestrandolo sul seguente training set TR: TR = {<D1,c1>, <D2,c1>, <D3,c2>, <D4,c2>} dove per ogni documento si riporta di seguito l’elenco delle parole in esso presenti, con le relative occorrenze: D1={T1:2, T2:3, T4:4} D2={T1:1, T3:2} D3={T2:2, T3:4} D4={T1:4, T4:2} NB: illustrare chiaramente tutte le fasi di costruzione del classificatore (PUNTI 6) b) Determinare la classe di appartenenza del seguente documento d={T3:2,T5:2} (PUNTI 2) 3) Descrivere in maniera sintetica i principi alla base del PageRank, focalizzando l’attenzione sulla formulazione basata sul Flow model (PUNTI 4) 4) Descrivere l’ontologia…

Anteprima

Prima pagina del documento.

Prima pagina: 20200131