[{"id":458164,"id_source":592921,"institutes":["ILC"],"type":"journal_article","type_order":1,"title":"Gli interventi redazionali negli esempi citati nelle voci del \u00abGrande Dizionario della Lingua Italiana\u00bb","year":2026,"authors":["Biffi, M.","Favaro, M.","Guadagnini, E.","Montemagni, S.","Sassolini, E."],"authors_source":"Biffi, Marco; Favaro, Manuel; Guadagnini, Elisa; Montemagni, Simonetta; Sassolini, Eva","authors_cnr_name":["FAVARO, MANUEL","GUADAGNINI, ELISA","MONTEMAGNI, SIMONETTA","SASSOLINI, EVA"],"authors_cnr_id":["rp13674","rp04485","rp16780","rp17670"],"authors_cnr_institute":[],"abstract":"La possibilit\u00e0 di consultare una versione informatizzata del Grande dizionario della lingua italiana (GDLI) permette, tra le altre cose, l\u2019accesso alla formidabile risorsa linguistica rappresentata dal ricco apparato degli esempi citati. Questo contributo si concentra sugli esempi \u201ccommentati\u201d, che costituiscono un corpus pari a poco meno di 1. 800 unit\u00e0: sono presenti segnalazioni di una varia lectio, chiose inserite nel dettato dalla redazione del GDLI e confronti tra edizioni diverse o diverse traduzioni di un medesimo testo di base. Il corpus \u00e8 per\u00f2 costituito in massima parte dalla registrazione di varianti d\u2019autore manzoniane, risultanti dal confronto tra l\u2019edizione \u201cventisettana\u201d e la \u201cquarantana\u201d dei Promessi sposi. Sono descritte la consistenza e le caratteristiche degli esempi \u201ccommentati\u201d, facendo riferimento alla risorsa digitale che deve gestirli","keywords":["Lessicografia, Filologia italiana, Digital Humanities"],"pages":"313-345","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/592921","volume":"43","doi":"","editors":[],"editors_source":"","published":"STUDI DI LESSICOGRAFIA ITALIANA","publisher":"","issn":"0392-5218","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2026-08-08 01:25:13","last_updated_oai":"2026-08-08 01:25:13","last_updated_www":"0000-00-00 00:00:00"},{"id":1073,"id_source":580341,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"From Print to Digital and Beyond: The Retrodigitization of a Historical Dictionary of Italian as a Hybrid Lexical Resource","year":2026,"authors":["Biffi, M.","Cucurullo, S.","Favaro, M.","Guadagnini, E.","Montemagni, S.","Sassolini, E."],"authors_source":"Biffi, Marco; Cucurullo, Sebastiana; Favaro, Manuel; Guadagnini, Elisa; Montemagni, Simonetta; Sassolini, Eva","authors_cnr_name":["CUCURULLO, SEBASTIANA","FAVARO, MANUEL","GUADAGNINI, ELISA","MONTEMAGNI, SIMONETTA","SASSOLINI, EVA"],"authors_cnr_id":["rp02365","rp13674","rp04485","rp16780","rp17670"],"authors_cnr_institute":[],"abstract":"This paper presents the retrodigitization project of the Grande Dizionario della Lingua Italiana (GDLI), the largest historical dictionary of the Italian language. The GDLI\u2019s 23, 000 pages-originally designed for human consultation-constitute an exceptional repository of linguistic and cultural-historical information, while posing significant challenges to large-scale digitization and data structuring. The project, still ongoing, will result in the development of a set of interoperable and interlinked resources: (i) a TEI-XML edition of the dictionary text, encoding its complex lexicographic structure; (ii) an annotated corpus of the quoted examples, enabling linguistic and historical research across centuries; and (iii) a database of quoted authors and works. Together, these components form a hybrid lexical resource that establishes the foundations for innovative and advanced modes of accessing and exploring the rich and multifaceted content of this historical dictionary","keywords":["Historical Dictionary, Retro-digitization, Knowledge Organization, e-Lexicography"],"pages":"770-777","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/580341","volume":"","doi":"10.63317\/338howsz93sg","editors":[],"editors_source":"","published":"Proceedings of the Fifteenth Language Resources and Evaluation Conference (LREC 2026)","publisher":"European Language Resources Association (ELRA)","issn":"","isbn":"9782493814494","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2026-07-09 00:17:39","last_updated_oai":"2026-07-09 00:17:39","last_updated_www":"0000-00-00 00:00:00"},{"id":1373,"id_source":580324,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"When Lexicographic Quotations Become a Corpus: To Deduplicate or Not to Deduplicate?","year":2026,"authors":["Favaro, M.","Guadagnini, E.","Sassolini, E.","Biffi, M.","Montemagni, S."],"authors_source":"Favaro, Manuel; Guadagnini, Elisa; Sassolini, Eva; Biffi, Marco; Montemagni, Simonetta","authors_cnr_name":["FAVARO, MANUEL","GUADAGNINI, ELISA","SASSOLINI, EVA","MONTEMAGNI, SIMONETTA"],"authors_cnr_id":["rp13674","rp04485","rp17670","rp16780"],"authors_cnr_institute":[],"abstract":"Historical dictionaries are increasingly reused as sources for diachronic language corpora. In this context, lexicographic quotations represent a valuable yet challenging type of data, as they are both editorially curated and diachronically representative. A major issue in their computational reuse is the presence of duplicate and nearduplicate quotations. This paper addresses quotation deduplication in corpora derived from lexicographic resources. We introduce QRD (Quotation Reuse Detection), a multi-stage pipeline designed to identify, compare, and cluster quotations based on graded similarity rather than binary matching. The approach combines string-based similarity measures, iterative threshold analysis, and clustering, enabling both quantitative and qualitative investigation of quotation reuse. Our results show that deduplication in this context cannot be reduced to the automatic elimination of redundant data. The variability observed in the quotations-ranging from OCR-related noise to substantial editorial variation-reflects both technical and structural factors and calls for a more nuanced approach. QRD supports the identification of OCR-related errors and reveals patterns of textual reuse underlying the compilation of the dictionary. We argue that quotation deduplication should be conceived primarily as a task of identification and clustering. This perspective reframes deduplication from a data-cleaning operation into an analytical methodology for historically and editorially curated textual resources","keywords":["Historical Corpora, Text Deduplication, Data Matching Process, Historical Lexicography"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/580324","volume":"","doi":"","editors":[],"editors_source":"","published":"Fourth Workshop on Language Technologies for Historical and Ancient Languages (LT4HALA 2026) @ LREC 2026","publisher":"ELRA Language Resources Association","issn":"","isbn":"9782493814586","conference_name":"Workshop on Language Technologies for Historical and Ancient Languages (LT4HALA 2026)","conference_place":"","conference_date":"","last_updated_cnr":"2026-07-04 00:10:44","last_updated_oai":"2026-07-03 14:50:13","last_updated_www":"0000-00-00 00:00:00"},{"id":1068,"id_source":579507,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Preserving Preserving and enhancing cultural heritage: the Digest project","year":2025,"authors":["Cinini, A.","Marongiu, P.","Sassolini, E.","Monachini, M."],"authors_source":"Alessandra Cinini, Paola Marongiu, Eva Sassolini, Monica Monachini","authors_cnr_name":[],"authors_cnr_id":[],"authors_cnr_institute":[],"abstract":"Valorizzare e custodire il patrimonio culturale: alla scoperta del progetto Digesto. Il contributo vuole discutere delle attivita connesse alla salvaguardia e alla valorizzazione di corpora testuali di valore storicoculturale prodotti in un lungo arco temporale. Analizzeremo le problematiche legate al progresso delle tecnologie utilizzate per la creazione\/elaborazione dei dati che sono mutate nel tempo, nonche l'arduo passaggio dai formati proprietari a quelli standard per una migliore condivisione e interoperabilita dei dati. Infine, descriveremo la non facile transizione verso paradigmi di dati aperti e i passaggi necessari per migrare i dati verso infrastrutture di ricerca internazionali. In particolare, descriveremo le fasi del progetto di traduzione del Digesto di Giustiniano che hanno richiesto il supporto tecnologico del nostro gruppo di ricerca, e come questo contributo e cambiato di pari passo con il progresso tecnologico. Vogliamo offrire alla comunita DH un punto di vista reale sull'evoluzione della digitalizzazione\/informatizzazione di grandi risorse testuali. Nel caso specifico, discuteremo del supporto alla traduzione specializzata dal latino all'italiano con strumenti di analisi testuale, e della trasformazione dei testi originali e tradotti in un corpus bilingue parallelo; di come questo e stato convertito in formato XML TEI; infine, delle operazioni necessarie al deposito dei dati all'interno dell'infrastruttura di ricerca CLARIN","keywords":["texts corpora, standard TEI format, digital preservation","corpora testuali, standard TEI, preservazione digitale"],"pages":"600-607","url":"https:\/\/amsacta.unibo.it\/id\/eprint\/8380\/","volume":"","doi":"10.6092\/unibo","editors":["Rebora, S.","Rospocher, M.","Bazzaco, S."],"editors_source":"Simone Rebora, Marco Rospocher, Stefano Bazzaco","published":"Diversita\u0300, Equita\u0300 e Inclusione: Sfide e Opportunita\u0300 per l\u2019Informatica Umanistica nell\u2019Era dell\u2019Intelligenza Artificiale, Proceedings del XIV Convegno Annuale AIUCD, Verona 11-13 giugno 2025, Universita\u0300 di Verona","publisher":"AIUCD (ITA)","issn":"","isbn":"978-88-942535-9-7","conference_name":"Diversita\u0300, Equita\u0300 e Inclusione: Sfide e Opportunita\u0300 per l\u2019Informatica Umanistica nell\u2019Era dell\u2019Intelligenza Artificiale","conference_place":"ITA","conference_date":"","last_updated_cnr":"0000-00-00 00:00:00","last_updated_oai":"2026-05-07 13:03:45","last_updated_www":"0000-00-00 00:00:00"},{"id":363,"id_source":571181,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"The Challenge of Obsolescence of Digital Archives in Cultural Heritage. A Case Study","year":2025,"authors":["Cucurullo, S.","Montemagni, S.","Saccoccio, R.","Sassolini, E."],"authors_source":"Cucurullo, Sebastiana; Montemagni, Simonetta; Saccoccio, Rubino; Sassolini, Eva","authors_cnr_name":["CUCURULLO, SEBASTIANA","MONTEMAGNI, SIMONETTA","SASSOLINI, EVA"],"authors_cnr_id":["rp02365","rp16780","rp17670"],"authors_cnr_institute":[],"abstract":"This paper addresses the challenges of format, font, and software obsolescence, with a particular emphasis on cultural heritage archives. While technological impermanence is intrinsic to the digital domain, it poses serious risks to the accessibility and long-term preservation of humanities data. Focusing on intangible cultural heritage\u2014specifically, dialect data\u2014we explore both the problems and opportunities associated with the FAIRification of legacy resources. A case study of the Atlante Lessicale Toscano (ALT), a dialectal lexical atlas of Tuscany originally published as a digital archive in 2000, illustrates how painstakingly collected linguistic data can be transformed into sustainable, interoperable formats that ensure long-term usability and scholarly value","keywords":["Humanities, Technological innovation, Relational databases, Linguistics, Cultural differences, Usability, Interoperability, Representation Standards, dialectal resources, digital obsolescence, FAIR data, heritage preservation"],"pages":"506-512","url":"https:\/\/xplorestaging.ieee.org\/document\/11224142","volume":"","doi":"10.1109\/CiSt65886.2025.11224142","editors":[],"editors_source":"","published":"Proceedings of the IEEE 8th Congress on Information Science and Technology (CiSt) 2025","publisher":"IEEE (MAR)","issn":"","isbn":"979-8-3315-4384-6","conference_name":"2025 IEEE 8th Congress on Information Science and Technology (CiSt)","conference_place":"MAR","conference_date":"","last_updated_cnr":"2026-07-09 00:17:41","last_updated_oai":"2026-07-09 00:17:41","last_updated_www":"0000-00-00 00:00:00"},{"id":1851,"id_source":550304,"institutes":["ILC"],"type":"journal_article","type_order":1,"title":"La stampa periodica citata nel GDLI: il rapporto tra voci e indice bibliografico e le prospettive per il dizionario strutturato","year":2024,"authors":["Biffi, M.","Guadagnini, E.","Montemagni, S.","Sassolini, E."],"authors_source":"Biffi, Marco; Guadagnini, Elisa; Montemagni, Simonetta; Sassolini, Eva","authors_cnr_name":["GUADAGNINI, ELISA","MONTEMAGNI, SIMONETTA","SASSOLINI, EVA"],"authors_cnr_id":["rp04485","rp16780","rp17670"],"authors_cnr_institute":[],"abstract":"L\u2019elemento caratterizzante del Grande dizionario della lingua italiana (GDLI) \u00e8 il ricchissimo apparato degli esempi, allegati per documentare gli impieghi di ogni voce nel corso dei secoli: ne fanno parte anche passi estratti dalla stampa periodica, in una quantit\u00e0 che tende ad aumentare sensibilmente nella seconda met\u00e0 del vocabolario. Questo contributo si articola in due parti: da un lato, saranno discussi metodi, risultati e prospettive per il collegamento \u2013 nella versione informatizzata del GDLI \u2013 tra gli esempi citati nelle voci e l\u2019Indice degli autori citati e per il trattamento dei citati non indicizzati; d\u2019altro canto, saranno presentati i primi risultati dell\u2019analisi delle stringhe bibliografiche che occorrono nella sezione degli esempi (che sono state estratte automaticamente dalla prima versione digitale strutturata del dizionario), con riferimento alla stampa periodica","keywords":["Lessicografia","Digital Humanities"],"pages":"267-294","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/550304","volume":"41","doi":"","editors":[],"editors_source":"","published":"STUDI DI LESSICOGRAFIA ITALIANA","publisher":"","issn":"0392-5218","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2026-03-04 19:26:43","last_updated_oai":"2026-03-04 19:26:43","last_updated_www":"0000-00-00 00:00:00"},{"id":58,"id_source":454366,"institutes":["ILC"],"type":"journal_article","type_order":1,"title":"Il lemmario del \u00abGDLI\u00bb: dati quantitativi e prime osservazioni","year":2023,"authors":["Biffi, M.","Guadagnini, E.","Montemagni, S.","Sassolini, E."],"authors_source":"Biffi, Marco; Guadagnini, Elisa; Montemagni, Simonetta; Sassolini, Eva","authors_cnr_name":["GUADAGNINI, ELISA","MONTEMAGNI, SIMONETTA","SASSOLINI, EVA"],"authors_cnr_id":["rp04485","rp16780","rp17670"],"authors_cnr_institute":[],"abstract":"Dopo la realizzazione della versione elettronica del solo testo del \"Grande dizionario della lingua italiana\" (GDLI), si \u00e8 avviato un progetto di graduale informatizzazione della sua struttura. Questo articolo ne presenta il primo risultato, vale a dire l'estrazione automatica del lemmario che \u00e8 cos\u00ec per la prima volta quantificabile e individuabile. Una prima parte del testo \u00e8 dedicata all'illustrazione della strutturazione dei contenuti del dizionario e la loro rappresentazione secondo standard internazionalmente riconosciuti (XML-TEI); la seconda presenta una prima elaborazione dei dati del lemmario estratto; la terza propone una prima analisi comparativa con i lemmari di altri dizionari della lingua italiana","keywords":["Lessicografia","Lessicografia digitale","Lessicografia storica"],"pages":"331-351","url":"https:\/\/accademiadellacrusca.it\/it\/riviste\/articoli\/slei-xl-2023\/8679","volume":"40","doi":"","editors":[],"editors_source":"","published":"STUDI DI LESSICOGRAFIA ITALIANA","publisher":"","issn":"0392-5218","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2025-01-24 01:51:41","last_updated_oai":"2025-01-24 01:51:41","last_updated_www":"0000-00-00 00:00:00"},{"id":988,"id_source":499985,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Un futuro digitale per gli archivi de \u2018Gli Anni della Cupola\u2019","year":2023,"authors":["Favaro, M.","Sassolini, E.","Cinini, A.","Haines, M."],"authors_source":"Favaro, Manuel; Sassolini, Eva; Cinini, Alessandra; Haines, Margaret","authors_cnr_name":["FAVARO, MANUEL","SASSOLINI, EVA","CININI, ALESSANDRA"],"authors_cnr_id":["rp13674","rp17670","rp21427"],"authors_cnr_institute":[],"abstract":"L\u2019articolo si inserisce tra le iniziative di recupero, salvaguardia e valorizzazione di archivi digitali conservati in formati non standard che l\u2019Istituto di Linguistica Computazionale \u201cA. Zampolli\u201d sta promuovendo da alcuni anni con diverse strategie legate alla natura delle risorse testuali trattate [8, 9 e 10]. In queste iniziative l\u2019istituto offre inoltre la possibilit\u00e0 di depositare gli output sull\u2019infrastruttura internazionale CLARIN1, al fine di garantirne la preservazione a lungo termine e la divulgazione. In questo particolare caso sono discussi i metodi, le criticit\u00e0 e le strategie di conversione di dati digitali strutturati e codificati con un sistema software proprietario, in un nuovo formato di rappresentazione in linea con gli standard internazionali TEI. Il contenuto \u00e8 costituito dall\u2019edizione completa delle fonti amministrative conservate presso l\u2019Opera di Santa Maria del Fiore di Firenze relative al periodo dal 1417 al 1436 quando fu progettata e costruita la Cupola di Brunelleschi. L\u2019intervento intende proporre una riflessione metodologica sulla standardizzazione di edizioni digitali obsolete, la conservazione a lungo termine e sulle problematiche legate alla condivisione dei dati con la comunit\u00e0 scientifica. Gli archivi hanno infatti un interesse multidisciplinare, non solo per le informazioni storiche e artistiche che vi sono contenute, ma anche per le peculiarit\u00e0 che riguardano la lingua in cui gli atti originali sono stati redatti: una delle pi\u00f9 antiche e autentiche attestazioni del volgare fiorentino, usato non con intenti letterari, ma pratici. Il processo di conversione riguarda tutti i materiali digitali, sia i metadati inseriti manualmente durante la preparazione dei testi, sia il contenuto originale degli atti, e mira a rappresentare opportunamente l\u2019edizione digitale dei testi, ma vuole anche conservare l\u2019apparato critico predisposto dai redattori che correda le schede di voci analitiche sulle quali si basano le funzioni di ricerca all\u2019epoca realizzate","keywords":["Digital Humanities, TEI mapping, corpora, knowledge discovery, knowledge representation"],"pages":"78-84","url":"https:\/\/amsacta.unibo.it\/id\/eprint\/7721\/","volume":"","doi":"10.6092\/unibo\/amsacta\/7721","editors":["Carbe\u0301, E."],"editors_source":"Carbe\u0301, Emmanuela","published":"La memoria digitale: forme del testo e organizzazione della conoscenza. Atti del XII Convegno Annuale AIUCD","publisher":"AIUCD-Associazione per l'informatica umanistica e la cultura digitale (SIENA, ITA)","issn":"","isbn":"9788894253573","conference_name":"XII Convegno Annuale AIUCD: La memoria digitale","conference_place":"SIENA","conference_date":"","last_updated_cnr":"2025-06-13 00:53:38","last_updated_oai":"2025-06-13 00:53:38","last_updated_www":"0000-00-00 00:00:00"},{"id":965,"id_source":458632,"institutes":["ILC"],"type":"journal_article","type_order":1,"title":"Parole in rete \/ reti di parole. Possibili impieghi didattici dei grandi vocabolari storici digitalizzati","year":2022,"authors":["Biffi, M.","De Blasi, F.","Favaro, M.","Guadagnini, E.","Montemagni, S.","Sassolini, E."],"authors_source":"Biffi, Marco; DE BLASI, Francesca; Favaro, Manuel; Guadagnini, Elisa; Montemagni, Simonetta; Sassolini, Eva","authors_cnr_name":["DE BLASI, FRANCESCA","FAVARO, MANUEL","GUADAGNINI, ELISA","MONTEMAGNI, SIMONETTA","SASSOLINI, EVA"],"authors_cnr_id":["rp10251","rp13674","rp04485","rp16780","rp17670"],"authors_cnr_institute":[],"abstract":"After a brief presentation of the great historical dictionaries of Italian, which are freeto use online thanks to the digitalisation work carried out by the Accademia dellaCrusca, the contribution offers a number of examples of how these tools can be usedfor educational purposes. Finally, further didactic uses are described, which will bemade possible thanks to the advanced digital tools that the Accademia della Cruscaand the Istituto di Linguistica Computazionale \"Antonio Zampolli\" del Consiglio Nazionaledelle Ricerche (ILC) are currently working on","keywords":["Lessicografia italiana","Didattica dell'italiano","Lessicografia digitale"],"pages":"143-188","url":"https:\/\/italianoascuola.unibo.it\/article\/view\/14866","volume":"4","doi":"10.6092\/issn.2704-8128\/14866","editors":[],"editors_source":"","published":"ITALIANO A SCUOLA","publisher":"","issn":"2704-8128","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2025-02-14 07:03:48","last_updated_oai":"2025-02-14 07:03:48","last_updated_www":"0000-00-00 00:00:00"},{"id":1507,"id_source":533922,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Towards the Creation of a Diachronic Corpus for Italian: a Case Study on the GDLI Quotations","year":2022,"authors":["Favaro, M.","Guadagnini, E.","Sassolini, E.","Biffi, M.","Montemagni, S."],"authors_source":"Favaro, Manuel; Guadagnini, Elisa; Sassolini, Eva; Biffi, Marco; Montemagni, Simonetta","authors_cnr_name":["FAVARO, MANUEL","GUADAGNINI, ELISA","SASSOLINI, EVA","MONTEMAGNI, SIMONETTA"],"authors_cnr_id":["rp13674","rp04485","rp17670","rp16780"],"authors_cnr_institute":[],"abstract":"In this paper we describe some experiments related to a corpus derived from an authoritative historical Italian dictionary, namely the Grande dizionario della lingua italiana (\u2018Great Dictionary of Italian Language\u2019, in short GDLI). Thanks to the digitization and structuring of this dictionary, we have been able to set up the first nucleus of a diachronic annotated corpus that selects\u2014according to specific criteria, and distinguishing between prose and poetry\u2014some of the quotations that within the entries illustrate the different definitions and sub-definitions. In fact, the GDLI presents a huge collection of quotations covering the entire history of the Italian language and thus ranging from the Middle Ages to the present day. The corpus was enriched with linguistic annotation and used to train and evaluate NLP models for POS tagging and lemmatization, with promising results","keywords":["Diachronic Corpus, Adaptation of Annotation Tools, Historical Dictionaries"],"pages":"94-100","url":"http:\/\/www.lrec-conf.org\/proceedings\/lrec2022\/workshops\/LT4HALA\/pdf\/2022.lt4hala2022-1.13.pdf","volume":"","doi":"","editors":["Sprugnoli, R.","Passarotti, M."],"editors_source":"Rachele Sprugnoli, Marco Passarotti","published":"Proceedings of the 2nd Workshop on Language Technologies for Historical and Ancient Languages","publisher":"European Language Resources Association (ELRA) (Paris, FRA)","issn":"","isbn":"979-10-95546-78-8","conference_name":"2nd Workshop on Language Technologies for Historical and Ancient Languages (LT4HALA 2022)","conference_place":"Paris","conference_date":"","last_updated_cnr":"2025-03-07 07:12:39","last_updated_oai":"2025-03-07 07:12:39","last_updated_www":"0000-00-00 00:00:00"},{"id":1271,"id_source":401787,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"La digitalizzazione del GDLI: un approccio linguistico per la corretta acquisizione del testo?","year":2021,"authors":["Sassolini, E.","Biffi, M.","De Blasi, F.","Guadagnini, E.","Montemagni, S."],"authors_source":"Sassolini, Eva; Biffi, Marco; DE BLASI, Francesca; Guadagnini, Elisa; Montemagni, Simonetta","authors_cnr_name":["SASSOLINI, EVA","DE BLASI, FRANCESCA","GUADAGNINI, ELISA","MONTEMAGNI, SIMONETTA"],"authors_cnr_id":["rp17670","rp10251","rp04485","rp16780"],"authors_cnr_institute":[],"abstract":"In questo articolo sono discussi metodi e strategie in via di elaborazione per la correzione (propedeutica alla successiva strutturazione) dei contenuti del Grande dizionario della lingua italiana (GDLI) fondato da Salvatore Battaglia, estratti da un formato digitale non standard. La presenza, in questo formato, di errori distribuiti di vario tipo ha condizionato la scelta dell'approccio all'estrazione e messo in luce tutte le difficolt\u00e0 dell'operazione. Le sperimentazioni fatte sino a oggi portano a privilegiare una strategia di correzione multilivello, che procede scomponendo in sezioni distinte l'individuazione e la correzione degli errori, in modo da rendere gestibili interventi complessi di correzione semi-automatica, altrimenti improponibili, e consentire un loro raffinamento progressivo. Parallelamente alla definizione di regole di riconoscimento di struttura e formato, stiamo analizzando metodi e procedure in grado di migliorare la qualit\u00e0 dell'input e specializzare i moduli di estrazione per i singoli campi della voce a partire dal \"lemma\". Le finalit\u00e0 del lavoro sono duplici: l'estrazione e strutturazione dei contenuti e la produzione di un formato standard di rappresentazione dei dati. Si tratta di un percorso difficile perch\u00e9 il formato dei dati rende l'uso di strumenti reperibili in letteratura non applicabile. Solamente al termine del lavoro potremo capire se esistono le condizioni per trasformare l'approccio adottato in un protocollo di intervento replicabile","keywords":["dizionari digitali","risorse linguistiche","estrazione dell'informazione","correzione del testo post OCR"],"pages":"159-166","url":"https:\/\/aiucd2021.labcd.unipi.it\/wp-content\/uploads\/2021\/05\/AIUCD2021_BOA-versione3A.pdf","volume":"","doi":"10.6092\/unibo\/amsacta\/6712","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"9788894253559","conference_name":"AIUCD 2021-DH per la societa\u0300: e-guaglianza, partecipazione, diritti e valori nell'era digitale","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-12 07:10:08","last_updated_oai":"2024-06-12 07:10:08","last_updated_www":"0000-00-00 00:00:00"},{"id":513,"id_source":401784,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Strategie e metodi per il recupero di dizionari storici","year":2020,"authors":["Sassolini, E.","Biffi, M."],"authors_source":"Sassolini Eva; Biffi Marco","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"The article describes ongoing work on the digitization of an authoritative and historically important Italian dictionary, namely Il Grande Dizionario della Lingua Italiana (GDLI) of S. Battaglia, with a focus on the stages of the conversion of this text into structured digital data. We report on the preliminary results of a collaboration between the Accademia della Crusca and Istituto di Linguistica Computazionale \"A. Zampolli\", which aims to extract the contents of the GDLI to convert them into structured digital data for human use, and\/or to be integrated with other language resources, both dictionaries and corpora. The extraction process is articulated on the one hand in the definition of data extraction procedures, on the other hand in the adoption of strategies aimed at supporting the correction of errors","keywords":["Archivi digitali","recupero e conservazione","estrazione dell'informazione"],"pages":"235-239","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/401784","volume":"","doi":"10.6092\/unibo\/amsacta\/6316","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"978-88-942535-4-2","conference_name":"IX Convegno annuale AIUCD: LA SVOLTA INEVITABILE: SFIDE E PROSPETTIVE PER L'INFORMATICA UMANISTICA","conference_place":"","conference_date":"","last_updated_cnr":"2024-03-13 20:36:04","last_updated_oai":"2024-03-13 20:36:04","last_updated_www":"0000-00-00 00:00:00"},{"id":2209,"id_source":389211,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Converting and structuring a digital historical dictionary of Italian: a case study","year":2019,"authors":["Sassolini, E.","Fahad Khan, A.","Biffi, M.","Monachini, M.","Montemagni, S."],"authors_source":"Sassolini, Eva; Fahad Khan, Anas; Biffi, Marco; Monachini, Monica; Montemagni, Simonetta","authors_cnr_name":["SASSOLINI, EVA","MONACHINI, MONICA","MONTEMAGNI, SIMONETTA"],"authors_cnr_id":["rp17670","rp19457","rp16780"],"authors_cnr_institute":[],"abstract":"The paper describes ongoing work on the digitization of an authoritative historical Italian dictionary, namely Il Grande Dizionario della Lingua Italiana (GDLI), with a specific view to creating the prerequisites for advanced human-oriented querying. After discussing the general approach taken to extract and structure the GDLI contents, in the paper we report the encouraging results of a case study carried out against two volumes which have been selected for the different conversion issues raised. Dictionary content extraction and structuring is being carried out through an iterative process based on hand coded patterns: starting from the recognition of the entry headword, a series of truth conditions are tested which allow the building and progressive structuring, in successive steps, of the whole lexical entry. We also started to design the representation of extracted and structured entries in a standard format, encoded in TEI. An outline of an example entry is also provided and illustrated in order to show what the end result will look like","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/389211","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-14 22:01:55","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":2003,"id_source":335238,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"I corpora digitali: dall'obsolescenza tecnologica, alla salvaguardia e alla condivisione","year":2017,"authors":["Sassolini, E.","Cucurullo, S.","Cinini, A."],"authors_source":"Eva Sassolini; Sebastiana Cucurullo; Alessandra Cinini","authors_cnr_name":["SASSOLINI, EVA","CUCURULLO, SEBASTIANA","CININI, ALESSANDRA"],"authors_cnr_id":["rp17670","rp02365","rp21427"],"authors_cnr_institute":[],"abstract":"Studio e implementazione di un protocollo di recupero, conservazione e valorizzazione di testi e corpora digitali interessati da problemi di obsolescenza tecnologica. Le strategie di salva-guardia adottate si spingono oltre il salvataggio dei testi e la conservazione in un formato di rappresentazione in linea con gli standard internazionali (XML TEI), si pongono come obiettivo la valorizzazione di questo patrimonio attraverso nuove modalit\u00e0 di fruizione dei contenuti. Lo scopo \u00e8 affiancare le funzionalit\u00e0 classiche di analisi testuale, che da sempre caratterizzano le nostre attivit\u00e0 di ricerca, a nuove modalit\u00e0 grafiche e visuali di fruizione dei dati e, in alcuni casi, migrare verso dispositivi mobili e tecnologie App. In questo articolo, oltre al protocollo di recupero, presentiamo due sperimentazioni di valorizzazione di contenuti testuali. Nel primo caso proponiamo tecniche di visual analytics applicate ad un corpus testuale semi strutturato riguardante corrispondenza redatta in lingua italiana del 1600. Nel secondo caso abbiamo realizzato un'applicazione per sistema Android finalizzata all'interrogazione di dati testuali relativi ad un progetto di censimento di architetture moderne della regione Liguria","keywords":["Testi digitali","Analisi testuale","Preservazione dei dati","Diffusione dei risultati"],"pages":"31-35","url":"https:\/\/www.garr.it\/it\/documenti\/3529-conferenza-2016-selected-papers-sassolini-et-al\/file","volume":"","doi":"10.26314\/GARR-Conf16-proceeedings-06","editors":[],"editors_source":"","published":"","publisher":"Consortium GARR (Roma, ITA)","issn":"","isbn":"978-88-905077-6-2","conference_name":"Conferenza GARR 2016-The CreActive Network","conference_place":"Roma","conference_date":"","last_updated_cnr":"2024-05-10 12:00:59","last_updated_oai":"2024-05-10 12:00:59","last_updated_www":"0000-00-00 00:00:00"},{"id":2032,"id_source":335262,"institutes":["ILC"],"type":"conference_misc","type_order":8,"title":"Approcci grafici all'analisi di corpora testuali","year":2017,"authors":["Sassolini, E.","Cinini, A."],"authors_source":"Sassolini, Eva; Cinini, Alessandra","authors_cnr_name":["SASSOLINI, EVA","CININI, ALESSANDRA"],"authors_cnr_id":["rp17670","rp21427"],"authors_cnr_institute":[],"abstract":"sperimentazioni finalizzate a combinare tecniche di \"distant reading\" e funzionalit\u00e0 classiche di Information Retrieval (IR) su dati testuali. Incrementare con sintesi grafiche e visuali l'offerta di strumenti di studio e di analisi dei dati testuali rappresenta una nuova frontiera del nostro ambito di ricerca consueto","keywords":["analisi testuale","distant reading","visual analytics"],"pages":"83-86","url":"http:\/\/aiucd2017.aiucd.it\/wp-content\/uploads\/2017\/01\/book-of-abstract-AIUCD-2017.pdf","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"AIUCD 2017 Conference","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-20 12:54:59","last_updated_oai":"2024-04-20 12:54:59","last_updated_www":"0000-00-00 00:00:00"},{"id":1863,"id_source":373360,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Rapporto Tecnico: Standardizzazione del corpus testuale del PRIN Crusca","year":2017,"authors":["Cinini, A.","Cucurullo, S.","Sassolini, E."],"authors_source":"Alessandra Cinini; Sebastiana Cucurullo; Eva Sassolini","authors_cnr_name":["CININI, ALESSANDRA","CUCURULLO, SEBASTIANA","SASSOLINI, EVA"],"authors_cnr_id":["rp21427","rp02365","rp17670"],"authors_cnr_institute":[],"abstract":"Attivit\u00e0 previste nella convenzione operativa tra ILC-CNR e Accademia della Crusca che riguardano la progettazione e lo sviluppo di una piattaforma Web modulare per l'archiviazione, la gestione e l'interrogazione di corpora testuali in lingua italiana, con funzionalit\u00e0 derivate dal DBT (Data Base Testuale) nelle sue diverse implementazioni. Il lavoro preliminare svolto riguarda anche la normalizzazione dei testi e la conversione nello standard di rappresentazione XML TEI","keywords":["Codifica dei testi","Analisi testuale","formato XML TEI"],"pages":"1-21","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/373360","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-03-22 23:39:20","last_updated_oai":"2024-03-22 23:39:20","last_updated_www":"0000-00-00 00:00:00"},{"id":753,"id_source":371867,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"DIGESTO: NUOVE FUNZIONALIT\u00c0 E SITO WEB","year":2017,"authors":["Sassolini, E.","Cinini, A."],"authors_source":"Eva Sassolini; Alessandra Cinini","authors_cnr_name":["SASSOLINI, EVA","CININI, ALESSANDRA"],"authors_cnr_id":["rp17670","rp21427"],"authors_cnr_institute":[],"abstract":"Realizzazione di un nuovo sito web per la consultazione dei testi bilingui, con sviluppo di nuove funzionalit\u00e0 di ricerca, non pi\u00f9 solo per parola ma anche per Titolo, Frammento o Paragrafo. Realizzazione di una versione PDF scaricabile di parti ragionate dell'intero corpus","keywords":["testi paralleli","sito web","analisi testuale","visual analytics"],"pages":"1-12","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/371867","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-12 06:47:44","last_updated_oai":"2024-06-12 06:47:44","last_updated_www":"0000-00-00 00:00:00"},{"id":2311,"id_source":335259,"institutes":["ILC"],"type":"journal_article","type_order":1,"title":"Corpora digitali: dalla salvaguardia alla condivisione","year":2016,"authors":["Sassolini, E."],"authors_source":"Eva Sassolini","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"Studio e sviluppo di metodi e tecniche che vanno nella direzione di una standardizzazione sia del formato dei file, in cui sono stati memorizzati i testi e\/o la loro elaborazione software, con procedure di annotazione e arricchimento del testo; sia del set dei caratteri utilizzati in fase di digitalizzazione. L'obiettivo \u00e8 recuperare il testo conservando tutte le preziose annotazioni che erano state oggetto di progetti e iniziative di ricerca. Data la grande variet\u00e0 dei progetti ai quali ILC ha partecipato e mancando in passato un modello condiviso di rappresentazione delle varie caratteristiche contenute nei testi, i formati dei file trovati sono molto diversi. Il lavoro di recupero \u00e8 divenuto quindi estremamente complesso. Parallelamente al recupero sono state attivate iniziative e strategie per la valorizzazione di questo patrimonio con l'intenzione di restituirlo alla comunit\u00e0","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/335259","volume":"","doi":"","editors":[],"editors_source":"","published":"GARR NEWS","publisher":"","issn":"2039-8271","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-24 12:35:58","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":154,"id_source":321018,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"ALT Explored: Integrating an Online Dialectometric Tool and an Online Dialect Atlas","year":2016,"authors":["Wieling, M.","Sassolini, E.","Cucurullo, S.","Montemagni, S."],"authors_source":"Martijn Wieling; Eva Sassolini; Sebastiana Cucurullo;Simonetta Montemagni","authors_cnr_name":["SASSOLINI, EVA","CUCURULLO, SEBASTIANA","MONTEMAGNI, SIMONETTA"],"authors_cnr_id":["rp17670","rp02365","rp16780"],"authors_cnr_institute":[],"abstract":"In this paper, we illustrate the integration of an online dialectometric tool, Gabmap, together with an online dialect atlas, the Atlante Lessicale Toscano (ALT-Web). By using a newly created url-based interface to Gabmap, ALT-Web is able to take advantage of the sophisticated dialect visualization and exploration options incorporated in Gabmap. For example, distribution maps showing the distribution in the Tuscan dialect area of a specific dialectal form (selected via the ALT-Web website) are easily obtainable. Furthermore, the complete ALT-Web dataset as well as subsets of the data (selected via the ALT-Web website) can be automatically uploaded and explored in Gabmap. By combining these two online applications, macro-and micro-analyses of dialectal data (respectively offered by Gabmap and ALT-Web) are effectively and dynamically combined","keywords":["Lexicon","Lexical Database","Tools","Systems","Applications"],"pages":"3265-3272","url":"http:\/\/www.lrec-conf.org\/proceedings\/lrec2016\/index.html","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"978-2-9517408-9-1","conference_name":"LREC 2016","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-21 15:58:43","last_updated_oai":"2024-05-21 15:58:43","last_updated_www":"0000-00-00 00:00:00"},{"id":1920,"id_source":335239,"institutes":["ILC"],"type":"conference_misc","type_order":8,"title":"I corpora digitali: dall'obsolescenza tecnologica, alla salvaguardia e alla condivisione","year":2016,"authors":["Sassolini, E.","Cucurullo, S.","Cinini, A."],"authors_source":"Sassolini, Eva; Cucurullo, Sebastiana; Cinini, Alessandra","authors_cnr_name":["SASSOLINI, EVA","CUCURULLO, SEBASTIANA","CININI, ALESSANDRA"],"authors_cnr_id":["rp17670","rp02365","rp21427"],"authors_cnr_institute":[],"abstract":"Il progetto di recupero, nato pochi anni fa come iniziativa fortemente voluta da ILC, prosegue oggi con la collaborazione di molte istituzioni pubbliche e private, impegnate sullo stesso fronte. Approccio al recupero a tappe: inizialmente lavorando su testi che erano stati prodotti per essere indicizzati con le prime procedure di analisi testuale presenti all'ILC sin dalla fine degli anni '70 del secolo scorso. Definizione di criteri da adottare per la scelta dei testi, basati sullo studio di casi significativi e sull'importanza dei materiali, spesso legati alla realizzazione di autorevoli progetti nazionali e internazionali","keywords":["recupero testi","conversione in formato XML","valorizzazione dei risultati"],"pages":"1-3","url":"https:\/\/www.eventi.garr.it\/it\/conf16\/home\/materiali-conferenza-2016\/paper","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"Conferenza GARR 2016-The CreActive Network","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-18 13:19:06","last_updated_oai":"2024-05-18 13:19:06","last_updated_www":"0000-00-00 00:00:00"},{"id":2324,"id_source":344119,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"La SALUTE MENTALE nel Web","year":2016,"authors":["Sassi, M.","Cinini, A.","Sassolini, E.","Cucurullo, S."],"authors_source":"Manuela Sassi; Alessandra Cinini; Eva Sassolini;Sebastiana Cucurullo","authors_cnr_name":["SASSI, MANUELA","CININI, ALESSANDRA","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21726","rp21427","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"Relazione annuale 2016 per la presentazione dei risultati raggiunti nell'ambito dell'Accordo di Collaborazione fra ILC-CNR e Coordinamento Toscano delle Associazioni per la Salute Mentale (Prot. ILC-CNR 0000856 del 4\/10\/2012) e del Contratto di sponsorizzazione Otsuka-Lundbeck del 2015, il cui Annesso Tecnico prevede le azioni descritte. Il progetto \u00e8 articolato nei seguenti obiettivi, che verranno perseguiti mediante le Azioni dettagliate di seguito: 1. Realizzazione di un Sito dedicato alla Salute Mentale; 2. Servizio automatizzato di ricerca su Internet di informazioni e notizie che riguardano la salute mentale, con procedure di analisi linguistica. Tale relazione \u00e8 stata presentata da Manuela Sassi al Corso finanziato dal CESVOT e organizzato dal Coordinamento Toscano delle Associazioni per la Salute Mentale a Lucca il 23 luglio 2016. Il sito realizzato viene aggiornato due volte al giorno e contiene i documenti recuperati in rete che hanno attinenza con la Salute Mentale tramite un dizionario di ricerca specializzato. Il periodo coperto inizia nel 2013 fino alla data odierna","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/344119","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-22 13:13:38","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":2334,"id_source":335264,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Strategie per la conversione in XML-TEI dei testi della biblioteca di Galileo","year":2015,"authors":["Sassolini, E."],"authors_source":"Eva Sassolini","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"Descrizione delle attivit\u00e0 svolte nell'ambito dell'accordo di collaborazione scientifica tra ILC-CNR e Museo Galileo di Firenze, per la conversione di tutti i testi presenti nella biblioteca Galileiana in Edizione FAVARO, in un formato standard di rappresentazione (XML TEI)","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/335264","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-10 12:06:05","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":983,"id_source":248752,"institutes":["ILC"],"type":"conference_misc","type_order":8,"title":"Industrial Philology: Problems and techniques of data and archives preservation for future generations","year":2014,"authors":["Sassolini, E.","Sassi, M.","Cucurullo, S.","Cinini, A.","Sbrulli, S."],"authors_source":"Sassolini, Eva; Sassi, Manuela; Cucurullo, Sebastiana; Cinini, Alessandra; Sbrulli, Stefano","authors_cnr_name":["SASSOLINI, EVA","SASSI, MANUELA","CUCURULLO, SEBASTIANA","CININI, ALESSANDRA"],"authors_cnr_id":["rp17670","rp21726","rp02365","rp21427"],"authors_cnr_institute":[],"abstract":"The main objective of digital archiving of texts is their re-use and preservation. The concept that guides these initiatives is linked to structural and organizational needs which heavily influence the definition of the format specifications that describe the organisation of the archives at various levels and consists of a more or less complex document. A format specification provides the details needed to build a file from a text, establishes the admitted encodings and software applications that can decode the file and make its content accessible. These structural specifications can have an extremely variable size and they depend on the complexity of the format. Although some format specifications are, for the most part, independent of the specific software (for example, ASCII and Unicode codes), many of them are related to the historical period in which the texts were acquired and also by dated software technologies. The file format specification should evolve hand in hand with the related software, and the fate of one is in fact often linked to that of the other. It is therefore appropriate to face the issue of obsolescence of software together with the obsolescence of file formats and of storage medium","keywords":["text management","text analysis"],"pages":"168-172","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/248752","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"1386-2316","isbn":"978-90-77484-22-7","conference_name":"GL15: Fifteenth International Conference on Grey Literature","conference_place":"","conference_date":"","last_updated_cnr":"2026-07-16 01:00:08","last_updated_oai":"2026-07-15 08:17:48","last_updated_www":"0000-00-00 00:00:00"},{"id":2450,"id_source":227909,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Semantic networks for improved access to biomedical databases","year":2013,"authors":["Sassolini, E.","Cucurullo, S.","Picchi, E."],"authors_source":"Sassolini, Eva; Sassolini, Eva; Cucurullo, Sebastiana; Cucurullo, Sebastiana; Picchi, Eugenio; Picchi, Eugenio","authors_cnr_name":["SASSOLINI, EVA","SASSOLINI, EVA","CUCURULLO, SEBASTIANA","CUCURULLO, SEBASTIANA","PICCHI, EUGENIO","PICCHI, EUGENIO"],"authors_cnr_id":["rp17670","rp17670","rp02365","rp02365","rp21020","rp21020"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/227909","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"978-90-77484-20-3","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-03 23:16:22","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":2423,"id_source":227915,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"I testi antichi: un patrimonio culturale da conservare e riutilizzare DIDAMATICA 2013, tecnologie e metodi per la didattica del futuro","year":2013,"authors":["Sassolini, E.","Sassi, M.","Cucurullo, S.","Cinini, A.","Sbrulli","Stefano"],"authors_source":"Sassolini, Eva; Sassolini, Eva; Sassi, Manuela; Sassi, Manuela; Cucurullo, Sebastiana; Cucurullo, Sebastiana; Cinini, Alessandra; Cinini, Alessandra; Sbrulli, ; Stefano,","authors_cnr_name":["SASSOLINI, EVA","SASSOLINI, EVA","SASSI, MANUELA","SASSI, MANUELA","CUCURULLO, SEBASTIANA","CUCURULLO, SEBASTIANA","CININI, ALESSANDRA","CININI, ALESSANDRA"],"authors_cnr_id":["rp17670","rp17670","rp21726","rp21726","rp02365","rp02365","rp21427","rp21427"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/227915","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"978-88-98091-10-2","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-16 12:59:05","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":2447,"id_source":333476,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Digesto 3. 0: il nuovo sistema di navigazione delle traduzioni del Digesto","year":2013,"authors":["Cinini, A.","Picchi, P.","Sassi, M.","Sassolini, E."],"authors_source":"Cinini, Alessandra; Picchi, Paolo; Sassi, Manuela; Sassolini, Eva","authors_cnr_name":["CININI, ALESSANDRA","PICCHI, PAOLO","SASSI, MANUELA","SASSOLINI, EVA"],"authors_cnr_id":["rp21427","rp11135","rp21726","rp17670"],"authors_cnr_institute":[],"abstract":"La sincronizzazione del testo latino e greco con la traduzione in italiano del Digesto si svolge nell'ambito del programma di ricerca PRIN 2008: Traduzione dei Digesta di Giustiniano: \"Lessico giuridico storia e dogmatica\", settore disciplinare IUS\/18. Nell'ambito del progetto sono stati implementati negli anni alcuni software, sviluppati dal Dr. Eugenio Picchi e dal suo gruppo di ricerca, dell'Istituto di Linguistica Computazionale del CNR di Pisa, per l'allineamento dei testi paralleli bilingui, in latino e italiano. Il progetto ha una lunga storia, caratterizzata da 3 fasi di sviluppo diverse. Con il titolo Digesto 3. 0 abbiamo cercato di ricordare quest'ultima evoluzione del progetto, caratterizzata da un nuovo sistema di navigazione on-line","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/333476","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-17 00:45:28","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":1512,"id_source":5167,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"SMARTCITY: Customized and Dynamic Multimedia Content Production for Tourism Applications","year":2012,"authors":["Spadoni, F.","Tartarelli, A.","Loparco, L.","Rossi, R.","Tariffi, F.","Sassolini, E.","Ongaro, P."],"authors_source":"Spadoni, Francesco; Tartarelli, A; Loparco, L; Rossi, R; Tariffi, Flavio; Sassolini, Eva; Ongaro, Paolo","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"This paper presents the SMARTCITY project experience: customized and dynamic multimedia content production for professional tourism applications","keywords":["Corpus Annotation","Cultural Heritage","Access To The Culture Information"],"pages":"132-137","url":"http:\/\/digital.casalini.it\/9788866551300","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"Electronic Imaging & the Visual Arts EVA 2012 Florence (EVA 2012 Florence)","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-17 00:37:23","last_updated_oai":"2024-04-17 00:37:23","last_updated_www":"0000-00-00 00:00:00"},{"id":1264,"id_source":122972,"institutes":["ILC"],"type":"misc","type_order":11,"title":"SMARTCITY: CUSTOMIZED AND DYNAMIC MULTIMEDIA CONTENT PRODUCTION FOR TOURISM APPLICATIONS","year":2012,"authors":["Spadoni, F.","Tartarelli, A.","Loparco, L.","Rossi, R.","Tariffi, F.","Sassolini, E.","Ongaro, P."],"authors_source":"Spadoni, Francesco; Tartarelli, A; Loparco, L; Rossi, R; Tariffi, Flavio; Sassolini, Eva; Ongaro, Paolo","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"This paper presents the final results of the SMARTCITY project, co-funded by the Tuscany Region under the POR CREO 1. d program. The project proposes an innovative methodology as well as advanced technologies enabling professional services for cultural tourism applications in urban areas as well larger archaeological sites","keywords":["Tourism application","Dynamic Multimedia Content Production","Semantic Annotation"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/122972","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-10 11:56:15","last_updated_oai":"2024-05-10 11:56:15","last_updated_www":"0000-00-00 00:00:00"},{"id":2513,"id_source":333710,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"THE \"MICRO SEMANTICS\" FOR INTELLIGENT BROWSING","year":2011,"authors":["Picchi, E.","Sassolini, E."],"authors_source":"Picchi, Eugenio; Picchi, Eugenio; Sassolini, Eva; Sassolini, Eva","authors_cnr_name":["PICCHI, EUGENIO","PICCHI, EUGENIO","SASSOLINI, EVA","SASSOLINI, EVA"],"authors_cnr_id":["rp21020","rp21020","rp17670","rp17670"],"authors_cnr_institute":[],"abstract":"Study and development of methodologies to improve systems of \"information retrieval\". Our approach is based on the integration of techniques, originally created to disciplines such as philology, lexicography, literature, with linguistic and statistical tools for the extraction and analysis of information in the text. Also we experimented a special methodology, for the creation of specific semantic metadata for text materials. In this paper, we describe \"SmartCity\", a project in which we applied these strategies. The project aims at designing and developing multimedia content (audio-guide for the new generation of interactive media and off-line and on-line) for the use of custom-cultural tourist routes, both physical (in the context of museums and cities) and virtual","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/333710","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"978-88-905639-8-0","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-05 18:52:03","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":261,"id_source":214957,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"The \"Micro Semantics\" for intelligent browsing","year":2011,"authors":["Picchi, E.","Sassolini, E."],"authors_source":"Picchi, Eugenio; Sassolini, Eva","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA"],"authors_cnr_id":["rp21020","rp17670"],"authors_cnr_institute":[],"abstract":"Study and development of methodologies to improve systems of \"information retrieval\". Our approach is based on the integration of techniques, originally created to disciplines such as philology, lexicography, literature, with linguistic and statistical tools for the extraction and analysis of information in the text. Also we experimented a special methodology, for the creation of specific semantic metadata for text materials. In this paper, we describe \"SmartCity\", a project in which we applied these strategies. The project aims at designing and developing multimedia content (audio-guide for the new generation of interactive media and off-line and on-line) for the use of custom-cultural tourist routes, both physical (in the context of museums and cities) and virtual","keywords":["Semantic Analysis","Information Retrieval","Text Mining"],"pages":"117-123","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/214957","volume":"4","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"978-88-905639-8-0","conference_name":"5th International Congress on \"Science and Technology for the Safeguard of Cultural Heritage in the Mediterranean Basin\"","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-06 11:17:15","last_updated_oai":"2024-04-06 11:17:15","last_updated_www":"0000-00-00 00:00:00"},{"id":891,"id_source":214332,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"SMARTCITY: Innovative Technologies for customized and dynamic multimedia content production for Tourism applications","year":2011,"authors":["Spadoni, F.","Tariffi, F.","Sassolini, E."],"authors_source":"F. Spadoni; Flavio Tariffi; Eva Sassolini","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"This paper presents the first results of the SMARTCITY project, co-funded by the Tuscany Region under the POR CREO 1. d program. the project proposess an innovative methodology as well as advanced technologies enabling professional services for cultural tourism applications in urban areas as well as larger archaeological sites","keywords":["smartcity project","Tourism Applications","Dynamic Multimedia Content Production"],"pages":"130-135","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/214332","volume":"","doi":"","editors":["Cappellini, V."],"editors_source":"Cappellini Vito","published":"","publisher":"Pitagora Editrice Bologna (Bologna, ITA)","issn":"","isbn":"88-371-1837-6","conference_name":"EVA 2011 Florence Electronic Imaging and the Visual Arts","conference_place":"Bologna","conference_date":"","last_updated_cnr":"2024-03-11 03:33:36","last_updated_oai":"2024-03-11 03:33:36","last_updated_www":"0000-00-00 00:00:00"},{"id":2504,"id_source":333475,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"SMARTCITY: Innovative Technologies for customized and dynamic multimedia content production for Tourism applications","year":2011,"authors":["Spadoni, F.","Tariffi, F.","Sassolini, E.",", E."],"authors_source":"Spadoni, F; Tariffi, F; Sassolini, Eva; E,","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"This paper presents the first results of the SMARTCITY project, co-funded by the Tuscany Region under the POR CREO 1. d program. the project proposess an innovative methodology as well as advanced technologies enabling professional services for cultural tourism applications in urban areas as well as larger archaeological sites","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/333475","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"88-371-1837-6","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-15 11:34:30","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":802,"id_source":174755,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"SmartCity-II relazione scientifica: report tecnico","year":2011,"authors":["Sassolini, E.","Cinini, A."],"authors_source":"Eva Sassolini;Alessandra Cinini","authors_cnr_name":["SASSOLINI, EVA","CININI, ALESSANDRA"],"authors_cnr_id":["rp17670","rp21427"],"authors_cnr_institute":[],"abstract":"This technical report presents the use of NLP techniques (text mining, text analysis) to develop specific tools that allow to create linguistic resources related to the cultural heritage domain, particularly \"Empoli e dintorni\"","keywords":["Corpus (creation","annotation","etc.)","Cultural Heritage"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/174755","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-03-20 13:18:15","last_updated_oai":"2024-03-20 13:18:15","last_updated_www":"0000-00-00 00:00:00"},{"id":494,"id_source":183039,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Metodologie di \"thorough indexing\" descrittivo, semantico e topologico delle risorse contenutistiche","year":2011,"authors":["Sassolini, E.","Cinini, A."],"authors_source":"Eva Sassolini; Alessandra Cinini","authors_cnr_name":["SASSOLINI, EVA","CININI, ALESSANDRA"],"authors_cnr_id":["rp17670","rp21427"],"authors_cnr_institute":[],"abstract":"D4 (deliverable) is the final result of task T2. 1. of Smartcity project. It analyzes the principles and methodologies of \"Thorough indexing\" of the text materials in order to define possible new rules for the application of a systematic approach to tagging of knowledge base","keywords":["Term extraction","Analisi Semantica"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/183039","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-09 13:16:03","last_updated_oai":"2024-06-09 13:16:03","last_updated_www":"0000-00-00 00:00:00"},{"id":734,"id_source":174798,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Primo report tecnico: tecnologie per il trattamento delle informazioni multimediali. ILC-CNR e STRAT-CRIT","year":2011,"authors":["Sassolini, E.","Stefano, S."],"authors_source":"Eva Sassolini; Sbrulli Stefano","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"Technologies for semantic annotation, automatic classification, clustering and browsing in textual databases, for realization of a multimedia on-line press review","keywords":["Information Extraction","Information Retrieval"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/174798","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-12 00:43:08","last_updated_oai":"2024-05-12 00:43:08","last_updated_www":"0000-00-00 00:00:00"},{"id":1401,"id_source":65171,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"\"Text power\": Tools for the cultural heritage","year":2010,"authors":["Picchi, E.","Sassolini, E."],"authors_source":"Picchi E.; Sassolini E.","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA"],"authors_cnr_id":["rp21020","rp17670"],"authors_cnr_institute":[],"abstract":"This article presents NLP techniques (text mining, text analysis) to create tools for the avaluation, analysis and classification of text materials available on the web. In particular we developed tools for the automatic extraction of mistic relevant information related to the cultural heritage domain and tools for linguistic resouces creation. On this knowledge basis, we also developed a system for text browsing","keywords":["information extraction","named entity recognition","text bvrowsing"],"pages":"435-439","url":"http:\/\/www.cairocongress.com\/","volume":"","doi":"","editors":["Ferrari, A."],"editors_source":"Angelo Ferrari","published":"Proceedings in: CHC 2010-4-th Intl. Congr. Science and Technology for the Safeguard of Cultural Heritage in the Mediterranean Basin (Il Cairo, 6-7-8\/12\/2009)","publisher":"","issn":"","isbn":"978-88-96680-31-5","conference_name":"4-th Intl. Congr. Science and Technology for the Safeguard of Cultural Heritage in the Mediterranean Basin","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-04 21:25:30","last_updated_oai":"2024-06-04 21:25:30","last_updated_www":"0000-00-00 00:00:00"},{"id":214,"id_source":65138,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Cultural Heritage: Knowledge Extraction from Web Documents","year":2010,"authors":["Sassolini, E.","Cinini, A."],"authors_source":"Sassolini, E; Cinini, A","authors_cnr_name":["SASSOLINI, EVA","CININI, ALESSANDRA"],"authors_cnr_id":["rp17670","rp21427"],"authors_cnr_institute":[],"abstract":"This article presents the use of NLP techniques (text mining, text analysis) to develop specific tools that allow to create linguistic resources related to the cultural heritage domain. The aim of our approach is to create tools for the building of an online \"knowledge network\", automatically extracted from text materials concerning this domain. A particular methodology was experimented by dividing the automatic acquisition of texts, and consequently, the creation of reference corpus in two phases. In the first phase, on-line documents have been extracted from lists of links provided by human experts. All documents extracted from the web by means of automatic spider have been stored in a repository of text materials. On the basis of these documents, automatic parsers create the reference corpus for the cultural heritage domain. Relevant information and semantic concepts are then extracted from this corpus. In a second phase, all these semantically relevant elements (such as proper names, names of institutions, names of places, and other relevant terms) have been used as basis for a new search strategy of text materials from heterogeneous sources. In this case also specialized crawlers (TP-crawler) have been used to work on a bulk of text materials available on line","keywords":["Information Extraction","Information Retrieval","Text mining","Named Entity recognition"],"pages":"3363-3368","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/65138","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"978-2-9517408-6-0","conference_name":"Seventh International Conference on Language Resources and Evaluation","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-05 10:49:27","last_updated_oai":"2024-04-05 10:49:27","last_updated_www":"0000-00-00 00:00:00"},{"id":468,"id_source":106759,"institutes":["ILC"],"type":"misc","type_order":11,"title":"La tecnologia TextPower per la navigazione intelligente","year":2010,"authors":["Picchi, E.","Sassolini, E."],"authors_source":"Picchi, E; Sassolini, E","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA"],"authors_cnr_id":["rp21020","rp17670"],"authors_cnr_institute":[],"abstract":"Compito dell'ILC \u00e8 di creare una rete di conoscenza linguistica, terminologica e semantica, estratta dai documenti, fatta di concetti che sintetizzano il valore semantico del documento. Questa rete di conoscenza individuata automaticamente costituisce la base conoscitiva necessaria alla classificazione e alla navigazione \"intelligente\" e rappresenta la ricchezza dello strumento e del servizio che l'Osservatorio pu\u00f2 offrire","keywords":["Text power","navigazione intelligente"],"pages":"419-425","url":"http:\/\/oraal.ittig.cnr.it\/oraal\/","volume":"1","doi":"","editors":["Sirsi, M. G. E."],"editors_source":"Marco Goldoni Eleonora Sirsi","published":"","publisher":"","issn":"","isbn":"88-14-17365-6","conference_name":"Convegno di inaugurazione dell'Osservatorio sulle Regole dell'Agricoltura e dell'Alimentazione","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-07 10:13:29","last_updated_oai":"2024-04-07 10:13:29","last_updated_www":"0000-00-00 00:00:00"},{"id":1357,"id_source":50342,"institutes":["ILC"],"type":"book_chapter","type_order":4,"title":"A Standard Lexical-Terminological Resource for the Bio Domain","year":2009,"authors":["Quochi, V.","Del Gratta, R.","Sassolini, E.","Bartolini, R.","Monachini, M.","Calzolari, N."],"authors_source":"Quochi, V; Del Gratta, R; Sassolini, E; Bartolini, R; Monachini, M; Calzolari, N","authors_cnr_name":["QUOCHI, VALERIA","DEL GRATTA, RICCARDO","SASSOLINI, EVA","BARTOLINI, ROBERTO","MONACHINI, MONICA"],"authors_cnr_id":["rp13283","rp00284","rp17670","rp00239","rp19457"],"authors_cnr_institute":[],"abstract":"The present paper describes a large-scale lexical resource for the biology domain designed both for human and for machine use. This lexicon aims at semantic interoperability and extendability, through the adoption of ISO-LMF standard for lexical representation and through a granular and distributed encoding of relevant information. The first part of this contribution focuses on three aspects of the model that are of particular interest to the biology community: the treatment of term variants, the representation on bio events and the alignment with a domain ontology. The second part of the paper describes the physical implementation of the model: a relational database equipped with a set of automatic uploading procedures. Peculiarity of the BioLexicon is that it combines features of both terminologies and lexicons. A set verbs relevant for the domain is also represented with full details on their syntactic and semantic argument structure","keywords":["Lexical representation model","Lexical Database","Computational Lexicography","Special Domains","Standards"],"pages":"325-335","url":"https:\/\/link.springer.com\/chapter\/10.1007\/978-3-642-04235-5_28","volume":"5603","doi":"10.1007\/978-3-642-04235-5_28","editors":[],"editors_source":"","published":"Human Language Technology. Challenges of the Information Society","publisher":"Springer (Berlin, Heidelberg, DEU)","issn":"","isbn":"978-3-642-04235-5","conference_name":"","conference_place":"Berlin, Heidelberg","conference_date":"","last_updated_cnr":"2025-03-06 01:01:34","last_updated_oai":"2025-03-06 01:01:34","last_updated_www":"0000-00-00 00:00:00"},{"id":307,"id_source":65122,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Text Power: tools for the Cultural Heritage","year":2009,"authors":["Sassolini, E.","Picchi, E."],"authors_source":"Sassolini E.; Picchi E.","authors_cnr_name":["SASSOLINI, EVA","PICCHI, EUGENIO"],"authors_cnr_id":["rp17670","rp21020"],"authors_cnr_institute":[],"abstract":"","keywords":["Text power","Text mining","Cultural Heritage"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/65122","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"4","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-01 01:02:17","last_updated_oai":"2024-05-01 01:02:17","last_updated_www":"0000-00-00 00:00:00"},{"id":1802,"id_source":65116,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Il progetto SUBITO e l'analisi semantica come strumento utile all'innovazione biomedica","year":2009,"authors":["Sassolini, E.","Picchi, E.","Ensini, M.","Guerriero, L."],"authors_source":"Sassolini, E; Picchi, E; Ensini, M; Guerriero, L","authors_cnr_name":["SASSOLINI, EVA","PICCHI, EUGENIO"],"authors_cnr_id":["rp17670","rp21020"],"authors_cnr_institute":[],"abstract":"","keywords":["Biomedicina","Analisi Semantica","Progetto\"Subito\""],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/65116","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"10\u00b0 Congresso Nazionale @ITIM 2009\/, Monserrato, Cagliari, Italy","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-11 13:52:38","last_updated_oai":"2024-06-11 13:52:38","last_updated_www":"0000-00-00 00:00:00"},{"id":536,"id_source":183235,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"WP3. 1 Tecniche di analisi semantica per l estrazione di ontologie bio-medicali","year":2009,"authors":["Picchi, E.","Sassolini, E.","Cucurullo, S.","Ensini, M."],"authors_source":"Picchi, Eugenio; Sassolini, Eva; Cucurullo, Sebastiana; Ensini, Monica","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":["Ontologie","Semantica computazionale","Terminologia medica"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/183235","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-26 11:27:16","last_updated_oai":"2024-06-26 11:27:16","last_updated_www":"0000-00-00 00:00:00"},{"id":2558,"id_source":333479,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Gli Anni della Cupola: NewDBT","year":2009,"authors":["Sassolini, E.","Haines, M."],"authors_source":"Sassolini Eva; Haines Margaret","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"programma NewDBT per l'Opera di Santa Maria del Fiore di Firenze. Sviluppo di una nuova versione di DBT strutturato per OPA in grado di indicizzare, gestire e interrogare il complesso archivio digitale riguardante la costruzione della cupola di Brunelleschi","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/333479","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-19 07:38:21","last_updated_oai":"0000-00-00 00:00:00","last_updated_www":"0000-00-00 00:00:00"},{"id":1428,"id_source":65093,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Mining the News with Semantic Press","year":2008,"authors":["Picchi, E.","Sassolini, E.","Cucurullo, S.","Bertagna, F."],"authors_source":"Picchi, E; Sassolini, E; Cucurullo, S; Bertagna, F","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":["Text mining","Press review"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/65093","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"LangTech 2008","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-18 15:34:20","last_updated_oai":"2024-06-18 15:34:20","last_updated_www":"0000-00-00 00:00:00"},{"id":1130,"id_source":65101,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Semantic Press","year":2008,"authors":["Picchi, E.","Sassolini, E.","Cucurullo, S.","Bertagna, F.","Baroni, P."],"authors_source":"Picchi E.; Sassolini E.; Cucurullo S.; Bertagna F.; Baroni P.","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA","CUCURULLO, SEBASTIANA","BARONI, PAOLA"],"authors_cnr_id":["rp21020","rp17670","rp02365","rp24987"],"authors_cnr_institute":[],"abstract":"In this paper <i>Semantic Press<\/i>, a tool for the automatic press review, is introduced. It is based on Text Mining technologies and is tailored to meet the needs of the eGovernment and eParticipation communities. First, a general description of the application demands emerging from the eParticipation and eGovernment sectors is offered. Then, an introduction to the framework of the automatic analysis and classification of newspaper content is provided, together with a description of the technologies underlying it","keywords":["Text Mining","Tools","Systems","Applications"],"pages":"2752-2756","url":"http:\/\/www.lrec-conf.org\/proceedings\/lrec2008\/","volume":"","doi":"","editors":["Calzolari, N.","Choukri, K.","Maegaard, B.","Mariani, J.","Odjik, J.","Piperidis, S.","Tapias, D."],"editors_source":"Nicoletta Calzolari (Conference Chair); Khalid Choukri; Bente Maegaard; Joseph Mariani; Jan Odjik; Stelios Piperidis; Daniel Tapias","published":"Proceedings of the Sixth International Conference on Language Resources and Evaluation","publisher":"European Language Resources Association (ELRA)-Evaluations and Language resources Distribution Agency (ELDA) (Paris, FRA)","issn":"","isbn":"2-9517408-4-0","conference_name":"LREC 2008-Sixth International Conference on Language Resources and Evaluation","conference_place":"Paris","conference_date":"","last_updated_cnr":"2024-12-04 00:26:52","last_updated_oai":"2024-12-04 00:26:52","last_updated_www":"0000-00-00 00:00:00"},{"id":1661,"id_source":192752,"institutes":["ILC"],"type":"misc","type_order":11,"title":"Semantic Press","year":2008,"authors":["Picchi, E.","Cucurullo, S.","Sassolini, E."],"authors_source":"Picchi E.; Cucurullo S.; Sassolini E.","authors_cnr_name":["PICCHI, EUGENIO","CUCURULLO, SEBASTIANA","SASSOLINI, EVA"],"authors_cnr_id":["rp21020","rp02365","rp17670"],"authors_cnr_institute":[],"abstract":"","keywords":["Rassegna stampa","Estrazione di informazione"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/192752","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2026-07-16 01:00:01","last_updated_oai":"2026-07-16 01:00:01","last_updated_www":"0000-00-00 00:00:00"},{"id":293,"id_source":192751,"institutes":["ILC"],"type":"misc","type_order":11,"title":"Progetto per lo studio e la realizzazione di un sistema di erogazione on line in modalit\u00e0 multicanale, dei servizi sanitari prioritari per cittadini e imprese","year":2008,"authors":["Sassolini, E.","Picchi, E.","Bellone, G.","Porquier, E."],"authors_source":"Sassolini E.; Picchi E.; Bellone G.; Porquier E.","authors_cnr_name":["SASSOLINI, EVA","PICCHI, EUGENIO"],"authors_cnr_id":["rp17670","rp21020"],"authors_cnr_institute":[],"abstract":"","keywords":["Studi statistici","Patologia"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/192751","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-04 11:44:26","last_updated_oai":"2024-05-04 11:44:26","last_updated_www":"0000-00-00 00:00:00"},{"id":417,"id_source":464694,"institutes":["ILC"],"type":"misc","type_order":11,"title":"Gli anni della Cupola","year":2008,"authors":["Sassolini, E.","Picchi, E.","Haines, M."],"authors_source":"Sassolini, E; Picchi, E; Haines, M","authors_cnr_name":["SASSOLINI, EVA","PICCHI, EUGENIO"],"authors_cnr_id":["rp17670","rp21020"],"authors_cnr_institute":[],"abstract":"","keywords":["Corpus trilingue di documenti antichi"],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/464694","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-06 11:05:55","last_updated_oai":"2024-04-06 11:05:55","last_updated_www":"0000-00-00 00:00:00"},{"id":50,"id_source":65109,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Toward a Standard Lexical Resource in the Bio Domain","year":2007,"authors":["Quochi, V.","Del Gratta, R.","Sassolini, E.","Monachini, M.","Calzolari, N."],"authors_source":"Quochi V, Del Gratta R, Sassolini E, Monachini M, Calzolari N","authors_cnr_name":[],"authors_cnr_id":[],"authors_cnr_institute":[],"abstract":"The present paper describes a large-scale lexical resource for the biology domain designed both for human and for machine use. This lexicon aims at semantic interoperability and extendability, through the adoption of ISO-LMF standard for lexical representation and through a granular and distributed encoding of relevant information. The first part of this contribution focuses on three aspects of the model that are of particular interest to the biology community: the treatment of term variants, the representation on bio events and the alignment with a domain ontology. The second part of the paper describes the physical implementation of the model: a relational database equipped with a set of automatic uploading procedures. Peculiarity of the BioLexicon is that it combines features of both terminologies and lexicons. A set verbs relevant for the domain is also represented with full details on their syntactic and semantic argument structure","keywords":["Lexical representation model","Lexical Database","Computational Lexicography","Special Domains","Standards"],"pages":"295-299","url":"","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"Fundacja Uniwersytetu im A. Mickiewicza (Poznan, POL)","issn":"","isbn":"978-83-7177-413-3","conference_name":"LTC07-3rd Language and Technology Conference: Human Language Technology. Challenges of the Information Society","conference_place":"Poznan","conference_date":"","last_updated_cnr":"0000-00-00 00:00:00","last_updated_oai":"2024-10-02 14:24:39","last_updated_www":"0000-00-00 00:00:00"},{"id":1620,"id_source":195940,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Bio-Lexicon DataBase: Architecture, Concepts and Loading Software","year":2007,"authors":["Del Gratta, R.","Monachini, M.","Quochi, V.","Sassolini, E.","Calzolari, N."],"authors_source":"Del Gratta, R; Monachini, M; Quochi, V; Sassolini, E; Calzolari, N","authors_cnr_name":["DEL GRATTA, RICCARDO","MONACHINI, MONICA","QUOCHI, VALERIA","SASSOLINI, EVA"],"authors_cnr_id":["rp00284","rp19457","rp13283","rp17670"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/195940","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-29 09:53:25","last_updated_oai":"2024-05-29 09:53:25","last_updated_www":"0000-00-00 00:00:00"},{"id":1914,"id_source":195941,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Implementazione di procedure di Clustering","year":2007,"authors":["Picchi, E.","Sassolini, E.","Cucurullo, S."],"authors_source":"Picchi E.; Sassolini E.; Cucurullo S.","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/195941","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-22 13:20:45","last_updated_oai":"2024-05-22 13:20:45","last_updated_www":"0000-00-00 00:00:00"},{"id":708,"id_source":195942,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Implementazione di procedure di Spidering per sistemi di Alerting","year":2007,"authors":["Picchi, E.","Sassolini, E.","Cucurullo, S."],"authors_source":"Picchi E.; Sassolini E.; Cucurullo S.","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/195942","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-15 12:00:14","last_updated_oai":"2024-05-15 12:00:14","last_updated_www":"0000-00-00 00:00:00"},{"id":1601,"id_source":457840,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Implementazione di procedure per la Named Entity Recognition","year":2007,"authors":["Picchi, E.","Sassolini, E.","Cucurullo, S."],"authors_source":"Picchi E.; Sassolini E.; Cucurullo S.","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/457840","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-03-28 19:12:28","last_updated_oai":"2024-03-28 19:12:28","last_updated_www":"0000-00-00 00:00:00"},{"id":268,"id_source":195948,"institutes":["ILC"],"type":"misc","type_order":11,"title":"ALT-Web. Sito dell Atlante Lessicale Toscano (ALT) in rete","year":2007,"authors":["Picchi, E.","Montemagni, S.","Cucurullo, S.","Sassolini, E.","Paoli, M."],"authors_source":"Picchi, E; Montemagni, S; Cucurullo, S; Sassolini, E; Paoli, M","authors_cnr_name":["PICCHI, EUGENIO","MONTEMAGNI, SIMONETTA","CUCURULLO, SEBASTIANA","SASSOLINI, EVA"],"authors_cnr_id":["rp21020","rp16780","rp02365","rp17670"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/195948","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2025-06-12 01:50:17","last_updated_oai":"2025-06-12 01:50:17","last_updated_www":"0000-00-00 00:00:00"},{"id":422,"id_source":195943,"institutes":["ILC"],"type":"misc","type_order":11,"title":"Legislazione Toscana raccolta e illustrata da Lorenzo Cantini","year":2007,"authors":["Picchi, E.","Sassolini, E.","Cucurullo S, C. D."],"authors_source":"Picchi E.; Sassolini E.; Cucurullo S. a cura di","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA"],"authors_cnr_id":["rp21020","rp17670"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/195943","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-03-13 20:18:07","last_updated_oai":"2024-03-13 20:18:07","last_updated_www":"0000-00-00 00:00:00"},{"id":1114,"id_source":64246,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Next Generation Language Resources using Grid","year":2006,"authors":["Calzolari, F.","Sassolini, E.","Sassi, M.","Cucurullo, S.","Picchi, E.","Bertagna, F.","Enea, A.","Monachini, M.","Soria, C.","Calzolari, N."],"authors_source":"Calzolari, F; Sassolini, E; Sassi, M; Cucurullo, S; Picchi, E; Bertagna, F; Enea, A; Monachini, M; Soria, C; Calzolari, N","authors_cnr_name":["SASSOLINI, EVA","SASSI, MANUELA","CUCURULLO, SEBASTIANA","PICCHI, EUGENIO","ENEA, ALESSANDRO","MONACHINI, MONICA","SORIA, CLAUDIA"],"authors_cnr_id":["rp17670","rp21726","rp02365","rp21020","rp19059","rp19457","rp17652"],"authors_cnr_institute":[],"abstract":"This paper presents a case study concerning the challenges and requirements posed by next generation language resources, realized as an overall model of open, distributed and collaborative language infrastructure. If a sort of \"new paradigm\" for language resource sharing is required, we think that the emerging and still evolving technology connected to Grid computing is a very interesting and suitable one for a concrete realization of this vision. Given the current limitations of Grid computing, it is very important to test the new environment on basic language analysis tools, in order to get the feeling of what are the potentialities and possible limitations connected to its use in NLP. For this reason, we have done some experiments on a module of the Linguistic Miner, i. e. the extraction of linguistic patterns from restricted domain corpora. The Grid environment has produced the expected results (reduction of the processing time, huge storage capacity, data redundancy) without any additional cost for the final user","keywords":["grid","acquisition","topic classification"],"pages":"1858-1861","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/64246","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"2-9517408-2-4","conference_name":"LREC 2006: 5th International Conference on Language Resources and Evaluation","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-13 11:04:36","last_updated_oai":"2024-04-13 11:04:36","last_updated_www":"0000-00-00 00:00:00"},{"id":252,"id_source":65014,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Dialectal resources on-line: the ALT-Web experience","year":2006,"authors":["Cucurullo, S.","Montemagni, S.","Paoli, M.","Picchi, E.","Sassolini, E."],"authors_source":"Cucurullo, S; Montemagni, S; Paoli, M; Picchi, E; Sassolini, E","authors_cnr_name":["CUCURULLO, SEBASTIANA","MONTEMAGNI, SIMONETTA","PICCHI, EUGENIO","SASSOLINI, EVA"],"authors_cnr_id":["rp02365","rp16780","rp21020","rp17670"],"authors_cnr_institute":[],"abstract":"The paper presents an on-line dialectal resource, ALT-Web, which gives access to the linguistic data of the Atlante Lessicale Toscano, a specially designed linguistic atlas in which lexical data have both a diatopic and diastratic characterisation. The paper focuses on: the dialectal data representation model; the access modalities to the ALT dialectal corpus; ontology-based search","keywords":["Computational dialectology","Dialectal databases","Construction of lexical resources"],"pages":"1846-1851","url":"http:\/\/www.lrec-conf.org\/lrec2006\/","volume":"","doi":"","editors":[],"editors_source":"","published":"Dialectal resources on-line: the ALT-Web experience","publisher":"","issn":"","isbn":"2-9517408-2-4","conference_name":"LREC 2006: 5th International Conference on Language Resources and Evaluation","conference_place":"","conference_date":"","last_updated_cnr":"2026-07-16 01:00:17","last_updated_oai":"2026-07-15 08:19:34","last_updated_www":"0000-00-00 00:00:00"},{"id":334,"id_source":65044,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Atlante Dialettale in rete: ALT-Web","year":2006,"authors":["Cucurullo, S.","Montemagni, S.","Paoli, M.","Picchi, E.","Sassolini, E."],"authors_source":"Cucurullo, S; Montemagni, S; Paoli, M; Picchi, E; Sassolini, E","authors_cnr_name":["CUCURULLO, SEBASTIANA","MONTEMAGNI, SIMONETTA","PICCHI, EUGENIO","SASSOLINI, EVA"],"authors_cnr_id":["rp02365","rp16780","rp21020","rp17670"],"authors_cnr_institute":[],"abstract":"The paper presents an on-line dialectal resource, ALT-Web, which gives access to the linguistic data of the Lexical Atlas of Tuscany or Atlante Lessicale Toscano, a specially designed linguistic atlas in which lexical data have both a diatopic and diastratic characterisation. The paper illustrates ALT-Web with particular emphasis on: 1) the dialectal data representation model; 2) the access modalities to the ALT dialectal corpus designed to produce an output tailored to the specific needs of the different classes of users (both professionals and common citizens); 3) ontology-based search. These represent three main features which differentiate ALT-Web both from the previous digitalised ALT version and, most interestingly, from other on-line dialectal resources. At the time of writing, this is the first resource of this type in Italy, and one of the few at the international level","keywords":["dialectal resources","information retrieval"],"pages":"661-672","url":"http:\/\/www.euralex.org\/publications\/","volume":"","doi":"","editors":["Corino, E.","Marello, C.","Onesti, C."],"editors_source":"E. Corino, C. Marello, C. Onesti","published":"Proceedings in 12\u00b0 EURALEX International Congress, Congresso internazionale di lessicografia","publisher":"Edizioni dell'ORSO (Alessandria, ITA)","issn":"","isbn":"8876949186","conference_name":"12\u00b0 EURALEX International Congress","conference_place":"Alessandria","conference_date":"","last_updated_cnr":"2026-07-16 01:00:25","last_updated_oai":"2026-07-15 08:19:46","last_updated_www":"0000-00-00 00:00:00"},{"id":1031,"id_source":195923,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Bio-Lexicon Model and Preliminary ISO Conformant Data Categories","year":2006,"authors":["Quochi, V.","Monachini, M.","Calzolari, N.","Del Gratta, R.","Sassolini, E."],"authors_source":"Quochi, V; Monachini, M; Calzolari, N; Del Gratta, R; Sassolini, E","authors_cnr_name":["QUOCHI, VALERIA","MONACHINI, MONICA","DEL GRATTA, RICCARDO","SASSOLINI, EVA"],"authors_cnr_id":["rp13283","rp19457","rp00284","rp17670"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/195923","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-01 00:38:26","last_updated_oai":"2024-05-01 00:38:26","last_updated_www":"0000-00-00 00:00:00"},{"id":1292,"id_source":192744,"institutes":["ILC"],"type":"misc","type_order":11,"title":"ALTWEB","year":2006,"authors":["Picchi, E.","Montemagni, S.","Sassolini, E.","Cucurullo, S.","Paoli, M."],"authors_source":"Picchi, E; Montemagni, S; Sassolini, E; Cucurullo, S; Paoli, M","authors_cnr_name":["PICCHI, EUGENIO","MONTEMAGNI, SIMONETTA","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp16780","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/192744","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-02 11:21:28","last_updated_oai":"2024-06-02 11:21:28","last_updated_www":"0000-00-00 00:00:00"},{"id":589,"id_source":192747,"institutes":["ILC"],"type":"misc","type_order":11,"title":"Linguistic Miner","year":2006,"authors":["Picchi, E.","Sassi, M.","Ceccotti, M. L.","Sassolini, E.","Cucurullo, S."],"authors_source":"Picchi E.; Sassi M.; Ceccotti M.L.; Sassolini E.; Cucurullo S.","authors_cnr_name":["PICCHI, EUGENIO","SASSI, MANUELA","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp21726","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/192747","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-03-23 12:32:13","last_updated_oai":"2024-03-23 12:32:13","last_updated_www":"0000-00-00 00:00:00"},{"id":625,"id_source":195901,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Atlante Lessicale Toscano in rete (ALT-Web). Relazione finale","year":2005,"authors":["Cucurullo, S.","Montemagni, S.","Paoli, M.","Picchi, E.","Sassolini, E."],"authors_source":"Cucurullo S.; Montemagni S.; Paoli M.; Picchi E.; Sassolini E.","authors_cnr_name":["CUCURULLO, SEBASTIANA","MONTEMAGNI, SIMONETTA","PICCHI, EUGENIO","SASSOLINI, EVA"],"authors_cnr_id":["rp02365","rp16780","rp21020","rp17670"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/195901","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2026-07-16 01:00:43","last_updated_oai":"2026-07-15 08:20:01","last_updated_www":"0000-00-00 00:00:00"},{"id":1261,"id_source":334028,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"P8\/L488-01: report tecnico di progetto","year":2005,"authors":["Sassolini, E.","Evangelista, A."],"authors_source":"Sassolini, Eva; Evangelista, Andrea","authors_cnr_name":["SASSOLINI, EVA"],"authors_cnr_id":["rp17670"],"authors_cnr_institute":[],"abstract":"Diffusione della cultura e valorizzazione del patrimonio letterario della lingua italiana e della lingua araba attraverso una diffusione telematica di banche dati letterarie","keywords":["trattamento della lingua araba","applicazione web"],"pages":"12","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/334028","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-23 13:47:27","last_updated_oai":"2024-06-23 13:47:27","last_updated_www":"0000-00-00 00:00:00"},{"id":227,"id_source":192738,"institutes":["ILC"],"type":"misc","type_order":11,"title":"Procedure e tecniche di acquisizione semi-automatica di terminologie da testi paralleli","year":2005,"authors":["Monachini, M.","Soria, C.","Picchi, E.","Sassolini, E.","Ruffolo, P."],"authors_source":"Monachini, M; Soria, C; Picchi, E; Sassolini, E; Ruffolo, P","authors_cnr_name":["MONACHINI, MONICA","SORIA, CLAUDIA","PICCHI, EUGENIO","SASSOLINI, EVA"],"authors_cnr_id":["rp19457","rp17652","rp21020","rp17670"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/192738","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-05 10:53:49","last_updated_oai":"2024-04-05 10:53:49","last_updated_www":"0000-00-00 00:00:00"},{"id":366,"id_source":192727,"institutes":["ILC"],"type":"misc","type_order":11,"title":"ALTWEB","year":2005,"authors":["Picchi, E.","Montemagni, S.","Sassolini, E.","Cucurullo, S.","Paoli, M."],"authors_source":"Picchi, E; Montemagni, S; Sassolini, E; Cucurullo, S; Paoli, M","authors_cnr_name":["PICCHI, EUGENIO","MONTEMAGNI, SIMONETTA","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp16780","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/192727","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2026-07-16 01:00:27","last_updated_oai":"2026-07-15 08:20:10","last_updated_www":"0000-00-00 00:00:00"},{"id":109,"id_source":464687,"institutes":["ILC"],"type":"misc","type_order":11,"title":"Linguistic Miner","year":2005,"authors":["Picchi, E.","Sassi, M.","Ceccotti, M. L.","Sassolini, E.","Cucurullo, S."],"authors_source":"Picchi E.; Sassi M.; Ceccotti M.L.; Sassolini E.; Cucurullo S.","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp17670","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/464687","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-03-23 00:27:19","last_updated_oai":"2024-03-23 00:27:19","last_updated_www":"0000-00-00 00:00:00"},{"id":223,"id_source":64236,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Linguistic Miner. An Italian Linguistic Knowledge System","year":2004,"authors":["Picchi, E.","Ceccotti, M. L.","Cucurullo, S.","Sassi, M.","Sassolini, E."],"authors_source":"Picchi E.; Ceccotti M.L.; Cucurullo S.; Sassi M.; Sassolini E.","authors_cnr_name":["PICCHI, EUGENIO","CUCURULLO, SEBASTIANA","SASSI, MANUELA","SASSOLINI, EVA"],"authors_cnr_id":["rp21020","rp02365","rp21726","rp17670"],"authors_cnr_institute":[],"abstract":"Linguistic Miner is a project carried out at ILC whose objective is the development of an integrated system to build, organise and manage a corpus of Italian texts (of various origins and formats), and to design and constantly add new tools for the automatic extraction of tiered linguistic knowledge to be made available for many teaching, publishing, and other cultural purposes. The project is based on a notion that is preliminary to all the systems for corpus-based linguistic analysis: a language represented by the largest possible collection of heterogeneous texts is the best source of linguistic information at any level of analysis considered. The first goals of such a system are the semi-automated construction of an Italian data mine for the extraction of linguistic information, the validation of linguistic patterns, the installation of useful tools and resources for a range of different categories of Italian language users. The main feature of the project is its purpose of building large language reference corpora allowing for the creation and use of effective tools for the handling and processing, as well as the automatic linguistic synthesis, of such corpora","keywords":["linguistic analysis","information extraction"],"pages":"1811-1814","url":"http:\/\/www.lrec-conf.org\/lrec2004\/","volume":"V","doi":"","editors":[],"editors_source":"","published":"Proceedings of the 4th International Conference on Language Resources and Evaluation","publisher":"","issn":"","isbn":"2-9517408-1-6","conference_name":"LREC 2004: Fourth International Conference on Language Resources and Evaluation","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-07 11:11:33","last_updated_oai":"2024-05-07 11:11:33","last_updated_www":"0000-00-00 00:00:00"},{"id":1541,"id_source":457832,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Report on the multilingual resources production","year":2004,"authors":["Gavrilidou, M.","Giouli, V.","Desipri, E.","Labropoulou, P.","Monachini, M.","Soria, C.","Picchi, E.","Ruffolo, P.","Sassolini, E."],"authors_source":"Gavrilidou, M; Giouli, V; Desipri, E; Labropoulou, P; Monachini, M; Soria, C; Picchi, E; Ruffolo, P; Sassolini, E","authors_cnr_name":["MONACHINI, MONICA","SORIA, CLAUDIA","PICCHI, EUGENIO","SASSOLINI, EVA"],"authors_cnr_id":["rp19457","rp17652","rp21020","rp17670"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/457832","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-05-24 13:42:05","last_updated_oai":"2024-05-24 13:42:05","last_updated_www":"0000-00-00 00:00:00"},{"id":977,"id_source":433717,"institutes":["ILC"],"type":"journal_article","type_order":1,"title":"Risorse monolingui e multilingui. Corpus bilingue italiano-arabo","year":2003,"authors":["Picchi, E.","Sassolini, E.","Nahli, O.","Cucurullo, S."],"authors_source":"Picchi, E; Sassolini, E; Nahli, O; Cucurullo, S","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA","NAHLI, OUAFAE","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp17670","rp03551","rp02365"],"authors_cnr_institute":[],"abstract":"Abstract-The objective of the project is twofold: on the one hand, the creation and elaboration of software procedures for the Arabic language and, on the other hand, the creation of linguistic resources for the management of large Arabic corpora. The linguistic resources are substantially the following: a) Morphological engine for the Arabic language. The engine is constituted by a number of modules: the algorithms and modules for generation and analysis, an appropriate encoding system for the representation of lexical data and of morphological characteristics of Arabic, the so-called \u0093lemmario\u0094, i. e. the archive of lemmas; b) The automatic alignment of parallel texts in Italian and Arabic language; c) Automatic tagging of Arabic texts, performed by using the above morphological engine; d) Systems for accessing and querying (raw and\/or tagged) Arabic texts and parallel Italian-Arabic corpora","keywords":["Morfologia araba","Corpora bilingui","Analisi testuale","Aligner","Tagger"],"pages":"629-678","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/433717","volume":"18-19","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2026-08-16 07:05:52","last_updated_oai":"2026-08-09 07:06:28","last_updated_www":"0000-00-00 00:00:00"},{"id":1107,"id_source":77204,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Linguistic Miner","year":2003,"authors":["Picchi, E.","Ceccotti, M.","Cignoni, L.","Cucurullo, N.","Fiorentini, G.","Sassi, M.","Sassolini, E.","Turrini, G."],"authors_source":"Picchi, E; Ceccotti, Ml; Cignoni, L; Cucurullo, N; Fiorentini, G; Sassi, M; Sassolini, E; Turrini, G","authors_cnr_name":["PICCHI, EUGENIO","CIGNONI, LAURA","SASSI, MANUELA","TURRINI, GIOVANNA"],"authors_cnr_id":["rp21020","rp03830","rp21726","rp22055"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/77204","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"Congresso annuale AICA 2003: I costi dell'ignoranza e il valore della conoscenza nella societa\u0300 dell'informazione","conference_place":"","conference_date":"","last_updated_cnr":"2024-04-26 23:18:26","last_updated_oai":"2024-04-26 23:18:26","last_updated_www":"0000-00-00 00:00:00"},{"id":1053,"id_source":222362,"institutes":["ILC"],"type":"conference_article","type_order":7,"title":"Italian Arabic Linguistic Tools","year":2002,"authors":["Picchi, E.","Sassolini, E.","Nahli, O.","Cucurullo, S.","Vargas Isabel, M."],"authors_source":"Picchi, Eugenio; Sassolini, Eva; Nahli, Ouafae; Cucurullo, Sebastiana; Vargas Isabel, Maria","authors_cnr_name":["PICCHI, EUGENIO","SASSOLINI, EVA","NAHLI, OUAFAE","CUCURULLO, SEBASTIANA"],"authors_cnr_id":["rp21020","rp17670","rp03551","rp02365"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/222362","volume":"","doi":"","editors":[],"editors_source":"","published":"Third International Conference on Language Resources and Evaluation","publisher":"","issn":"","isbn":"","conference_name":"LREC 2002","conference_place":"","conference_date":"","last_updated_cnr":"2025-01-11 00:58:45","last_updated_oai":"2025-01-11 00:58:45","last_updated_www":"0000-00-00 00:00:00"},{"id":722,"id_source":222368,"institutes":["ILC"],"type":"technical_report","type_order":9,"title":"Motore morfologico della lingua araba","year":2002,"authors":["Sassolini, E.","Nahli, O."],"authors_source":"Sassolini, Eva; Nahli, Ouafae","authors_cnr_name":["SASSOLINI, EVA","NAHLI, OUAFAE"],"authors_cnr_id":["rp17670","rp03551"],"authors_cnr_institute":[],"abstract":"","keywords":[],"pages":"","url":"https:\/\/iris.cnr.it\/handle\/20.500.14243\/222368","volume":"","doi":"","editors":[],"editors_source":"","published":"","publisher":"","issn":"","isbn":"","conference_name":"","conference_place":"","conference_date":"","last_updated_cnr":"2024-06-12 06:49:45","last_updated_oai":"2024-06-12 06:49:45","last_updated_www":"0000-00-00 00:00:00"}]