{"id":{"repo_id":"catania","oai_identifier":"oai:www.iris.unict.it:20.500.11769/581930"},"canonical_url":"https://search.dev.ndltd.org/etd/catania/oai:www.iris.unict.it:20.500.11769/581930","repository":{"repo_id":"catania","name":"Università degli Studi di Catania","base_url":"https://www.iris.unict.it/oai/request"},"display":{"title":"BioTAGME: Piattaforma per l'analisi di reti di conoscenza Biologica","abstract":"L'estrazione di conoscenza dall'analisi della letteratura è un aspetto fondamentale per fare nuove scoperte scienifiche e guadagnare conoscenza riguardo relazioni tra componenti biologiche. Specialmente nel mondo della biomedicina, grazie alla conoscienza di base messa a disposizione da bance dati online, questo processo permette di ottenere informazioni da aspetti ampiamente investigati da altri ricercatori. L'estrazione atomarica di informazione sottoforma di Tag sta dientando un aspetto fondamentale. A tal riguardo, proponiamo BioTAGME un framework che combina il sistema di annotazione TAGME basato sul corpus Wikipedia con la metodologia di predizione prevista dall'algorito DT-Hybrid. L'obiettivo è quello di estrarre termini biologici da una collezione di testi in PubMED, e derivare i link di connessione tra quest'ultimi al fine di costruire un grafo di conoscenza. L'architettura consiste di un backend implementato in SPARK al fine di distribuire il calcolo computazionale tra molteplici macchine, e da un frontend implementato in React e JavaScript. Inolte, la rete prodotta è memorizzata in Neo4j. Inoltre, un ulteriore lavoro è stato presentato in questa tesi, chiamato NetME, che permette di costruire una rete di conoscenza \"on the fly\" a partire da una collezione di full text ottenuti da una query effettuata su PubMed Central ed applicando tecniche di sentiment analysis.","abstract_html":"L&#x27;estrazione di conoscenza dall&#x27;analisi della letteratura è un aspetto fondamentale per fare nuove scoperte scienifiche e guadagnare conoscenza riguardo relazioni tra componenti biologiche. Specialmente nel mondo della biomedicina, grazie alla conoscienza di base messa a disposizione da bance dati online, questo processo permette di ottenere informazioni da aspetti ampiamente investigati da altri ricercatori. L&#x27;estrazione atomarica di informazione sottoforma di Tag sta dientando un aspetto fondamentale. A tal riguardo, proponiamo BioTAGME un framework che combina il sistema di annotazione TAGME basato sul corpus Wikipedia con la metodologia di predizione prevista dall&#x27;algorito DT-Hybrid. L&#x27;obiettivo è quello di estrarre termini biologici da una collezione di testi in PubMED, e derivare i link di connessione tra quest&#x27;ultimi al fine di costruire un grafo di conoscenza. L&#x27;architettura consiste di un backend implementato in SPARK al fine di distribuire il calcolo computazionale tra molteplici macchine, e da un frontend implementato in React e JavaScript. Inolte, la rete prodotta è memorizzata in Neo4j. Inoltre, un ulteriore lavoro è stato presentato in questa tesi, chiamato NetME, che permette di costruire una rete di conoscenza &quot;on the fly&quot; a partire da una collezione di full text ottenuti da una query effettuata su PubMed Central ed applicando tecniche di sentiment analysis.","abstract_has_math":false,"creators":["DI MARIA, ANTONIO"],"institution":"Università degli studi di Catania","degree_name":null,"degree_level":null,"degree_discipline":null,"degree_department":null,"school":null,"contributors":["PULVIRENTI, ALFREDO"],"advisors":[],"committee_chairs":[],"committee_members":[],"year":2021,"date_issued":"2021-02-26","date_published":"2021-02-26","updated_at":"2026-07-24T01:35:06Z","subjects":["Knowledge Graph, Document Annotation, Prediction Algorithms, Sentimental Analysis Methodologies, Apache SPARK, HDFS, Neo4j","Rete di conoscenza, Annotazione di documenti, Algoriti di predizione, Metodologie basate su sentimental analysis, Apache Spark, HDFS, Neo4j"],"languages":["ita"],"rights":["info:eu-repo/semantics/openAccess","license:PUBBLICO - Pubblico con Copyright","license uri:iris.PUB02"],"rights_urls":[],"identifier_entries":[]},"links":{"outbound_url":"https://hdl.handle.net/20.500.11769/581930","outbound_label":"Handle","outbound_source":"dc:identifier"},"metadata_groups":[{"id":"people","label":"People","entries":[{"key":"dc:contributor","label":"Contributor","values":["DI MARIA, Antonio","PULVIRENTI, ALFREDO"]},{"key":"dc:creator","label":"Author","values":["DI MARIA, ANTONIO"]}]},{"id":"academic_context","label":"Academic Context","entries":[{"key":"dc:date","label":"Dc Date","values":["2021-02-26"]},{"key":"dc:publisher","label":"Institution","values":["Università degli studi di Catania","place:Catania"]},{"key":"dc:type","label":"Dc Type","values":["info:eu-repo/semantics/doctoralThesis"]}]},{"id":"subjects_keywords","label":"Subjects and Keywords","entries":[{"key":"dc:subject","label":"Dc Subject","values":["Knowledge Graph, Document Annotation, Prediction Algorithms, Sentimental Analysis Methodologies, Apache SPARK, HDFS, Neo4j","Rete di conoscenza, Annotazione di documenti, Algoriti di predizione, Metodologie basate su sentimental analysis, Apache Spark, HDFS, Neo4j"]}]},{"id":"language_rights","label":"Language and Rights","entries":[{"key":"dc:language","label":"Dc Language","values":["ita"]},{"key":"dc:rights","label":"Dc Rights","values":["info:eu-repo/semantics/openAccess","license:PUBBLICO - Pubblico con Copyright","license uri:iris.PUB02"]}]},{"id":"identifiers","label":"Identifiers","entries":[{"key":"dc:identifier","label":"Identifier","values":["https://hdl.handle.net/20.500.11769/581930"]}]},{"id":"additional","label":"Additional Metadata","entries":[{"key":"dc:description","label":"Description","values":["L'estrazione di conoscenza dall'analisi della letteratura è un aspetto fondamentale per fare nuove scoperte scienifiche e guadagnare conoscenza riguardo relazioni tra componenti biologiche. Specialmente nel mondo della biomedicina, grazie alla conoscienza di base messa a disposizione da bance dati online, questo processo permette di ottenere informazioni da aspetti ampiamente investigati da altri ricercatori. L'estrazione atomarica di informazione sottoforma di Tag sta dientando un aspetto fondamentale. A tal riguardo, proponiamo BioTAGME un framework che combina il sistema di annotazione TAGME basato sul corpus Wikipedia con la metodologia di predizione prevista dall'algorito DT-Hybrid. L'obiettivo è quello di estrarre termini biologici da una collezione di testi in PubMED, e derivare i link di connessione tra quest'ultimi al fine di costruire un grafo di conoscenza. L'architettura consiste di un backend implementato in SPARK al fine di distribuire il calcolo computazionale tra molteplici macchine, e da un frontend implementato in React e JavaScript. Inolte, la rete prodotta è memorizzata in Neo4j. Inoltre, un ulteriore lavoro è stato presentato in questa tesi, chiamato NetME, che permette di costruire una rete di conoscenza \"on the fly\" a partire da una collezione di full text ottenuti da una query effettuata su PubMed Central ed applicando tecniche di sentiment analysis.","The inference of novel knowledge and the generation of new hypotheses from the analysis of the current literature is a fundamental process in making new scientific discoveries, and gaining knowledge about relations among biological elements. Especially in bio-medicine, given the enormous amount of literature and knowledge bases available, this process allows the researchers to obtain information on aspects already widely investigated by others researchers. The automatic extraction of information in the form of semantically related terms (or tags) is becoming an importance aspect. Here we propose BioTAGME framework that combines TAGME annotation framework based on Wikipedia corpus (Ferragina and Scaiella, 2010), with the DT-Hybrid methodology. The aim of this combination is to extract biological terms from scientific documents available in PubMed, and predicts possible relationships among them in order to generate a knowledge graph. The proposed framework consist of two pipeline. The first one is entirely implemented in Spark in order to distribute the computing among several machines. It will be employed to annotate documents, and predict relationships among biological terms. Instead, the second one use the Laravel model-view-controller framework for the User Interface realization, and Neo4j graph database for storing the knowledge graph. In this thesis I also describe another project, called NetME, realized during the PhD. It allows to build an on-the-fly knowledge graphs starting from a subset of full texts obtained by a real-time query on PubMed and applying several semantic analysis methodologies."]},{"key":"dc:title","label":"Title","values":["BioTAGME: Piattaforma per l'analisi di reti di conoscenza Biologica"]}]}],"canonical_facts":{"dc:contributor":["DI MARIA, Antonio","PULVIRENTI, ALFREDO"],"dc:creator":["DI MARIA, ANTONIO"],"dc:date":["2021-02-26"],"dc:description":["L'estrazione di conoscenza dall'analisi della letteratura è un aspetto fondamentale per fare nuove scoperte scienifiche e guadagnare conoscenza riguardo relazioni tra componenti biologiche. Specialmente nel mondo della biomedicina, grazie alla conoscienza di base messa a disposizione da bance dati online, questo processo permette di ottenere informazioni da aspetti ampiamente investigati da altri ricercatori. L'estrazione atomarica di informazione sottoforma di Tag sta dientando un aspetto fondamentale. A tal riguardo, proponiamo BioTAGME un framework che combina il sistema di annotazione TAGME basato sul corpus Wikipedia con la metodologia di predizione prevista dall'algorito DT-Hybrid. L'obiettivo è quello di estrarre termini biologici da una collezione di testi in PubMED, e derivare i link di connessione tra quest'ultimi al fine di costruire un grafo di conoscenza. L'architettura consiste di un backend implementato in SPARK al fine di distribuire il calcolo computazionale tra molteplici macchine, e da un frontend implementato in React e JavaScript. Inolte, la rete prodotta è memorizzata in Neo4j. Inoltre, un ulteriore lavoro è stato presentato in questa tesi, chiamato NetME, che permette di costruire una rete di conoscenza \"on the fly\" a partire da una collezione di full text ottenuti da una query effettuata su PubMed Central ed applicando tecniche di sentiment analysis.","The inference of novel knowledge and the generation of new hypotheses from the analysis of the current literature is a fundamental process in making new scientific discoveries, and gaining knowledge about relations among biological elements. Especially in bio-medicine, given the enormous amount of literature and knowledge bases available, this process allows the researchers to obtain information on aspects already widely investigated by others researchers. The automatic extraction of information in the form of semantically related terms (or tags) is becoming an importance aspect. Here we propose BioTAGME framework that combines TAGME annotation framework based on Wikipedia corpus (Ferragina and Scaiella, 2010), with the DT-Hybrid methodology. The aim of this combination is to extract biological terms from scientific documents available in PubMed, and predicts possible relationships among them in order to generate a knowledge graph. The proposed framework consist of two pipeline. The first one is entirely implemented in Spark in order to distribute the computing among several machines. It will be employed to annotate documents, and predict relationships among biological terms. Instead, the second one use the Laravel model-view-controller framework for the User Interface realization, and Neo4j graph database for storing the knowledge graph. In this thesis I also describe another project, called NetME, realized during the PhD. It allows to build an on-the-fly knowledge graphs starting from a subset of full texts obtained by a real-time query on PubMed and applying several semantic analysis methodologies."],"dc:identifier":["https://hdl.handle.net/20.500.11769/581930"],"dc:language":["ita"],"dc:publisher":["Università degli studi di Catania","place:Catania"],"dc:rights":["info:eu-repo/semantics/openAccess","license:PUBBLICO - Pubblico con Copyright","license uri:iris.PUB02"],"dc:subject":["Knowledge Graph, Document Annotation, Prediction Algorithms, Sentimental Analysis Methodologies, Apache SPARK, HDFS, Neo4j","Rete di conoscenza, Annotazione di documenti, Algoriti di predizione, Metodologie basate su sentimental analysis, Apache Spark, HDFS, Neo4j"],"dc:title":["BioTAGME: Piattaforma per l'analisi di reti di conoscenza Biologica"],"dc:type":["info:eu-repo/semantics/doctoralThesis"]},"updated_at":"2026-07-24T01:35:06Z"}