Back
ExamFull examExam paper onlyItalian

20210413

Study material for Metodi per il ritrovamento dell'informazione, shared by the Studwiz community and reviewed by moderators.

Metodi per il ritrovamento dell'informazioneFull exam

Document information

What's included in this study material

Study material for Metodi per il ritrovamento dell'informazione, shared by the Studwiz community and reviewed by moderators.

Import quality: text was extracted directly from the original document.

Extracted content from the document

Representative passages recognised in different parts of the material. The full extracted text remains available to search, while this compact preview makes the page easier to read.

Page 1

Prova scritta di METODI PER IL RITROVAMENTO DELL’INFORMAZIONE C.d.L. in Informatica - A.A. 2019-20 Docente: P. Lops - 13 Aprile 2021 Nome e Cognome : ___________________________________________ Matricola : ___________________________________________ 1) Sia q una query che ha 5 documenti rilevanti nella collezione. Supponiamo che un algoritmo di ritrovamento applicato a q riporti il seguente ranking Rq: D1 D5 D3 D7 D9 D4 Supponiamo che D1, D7 e D4 siano documenti rilevanti per q a) Fornire la descrizione sintetica delle metriche: F1, R-Precision ed Average Precision (PUNTI 3) b) Calcolare F1, R-Precision ed Average Precision per la query q (PUNTI 3) 2) Siano dati l’insieme delle categorie C = {c1, c2} e una collezione di 100 documenti definiti sul vocabolario V = {T1,T2,T3,T4,T5}. a) Costruire un classificatore bayesiano per C, addestrandolo sul seguente training set TR: TR = {<D1,c1>, <D2,c1>, <D3,c2>, <D4,c2>} dove per ogni docu mento si riporta di seguito l’elenco delle parole in esso presenti, con le relative occorrenze: D1={T1:2, T2:3, T4:4} D2={T1:1, T3:2} D3={T2:2, T3:4} D4={T1:4, T4:2} NB: illustrare chiaramente tutte le fasi di costruzione del classificatore (PUNTI 7) b) Determinare la classe di appartenenza del seguente documento d={T3:2,T5:2} (PUNTI 2) 3) Descrivere in maniera sintetica i principi alla base del PageRank, focalizzando l’attenzione sulla formulazione basata sul Flow model (PUNTI 5) 4) Descrivere l’ontologia linguistica WordNet ed indicare come è organizzata e rapp resentata la conoscenza lessicale al suo interno. (PUNTI 5) 5) Descrivere, commentando opportunamente, la funzione per il calcolo delle predizioni dei rating in un algoritmo di filtraggio collaborativo di tipo user to user. (PUNTI 5)

Preview

First page of the document.

First page: 20210413