{"id":{"repo_id":"brazil-ufpe","oai_identifier":"oai:repositorio.ufpe.br:123456789/67304"},"canonical_url":"https://search.dev.ndltd.org/etd/brazil-ufpe/oai:repositorio.ufpe.br:123456789/67304","repository":{"repo_id":"brazil-ufpe","name":"Brazil UFPE","base_url":"https://repositorio.ufpe.br/oai/request"},"display":{"title":"Uma metodologia baseada em grafos para detecção de redundância estrutural em Arquiteturas Data Mesh","abstract":"A adoção do paradigma Data Mesh tem impulsionado a descentralização da posse de dados nas organizações, permitindo que cada domínio de negócio gerencie seus próprios produtos de dados. Embora essa abordagem aumente a autonomia e a flexibilidade, ela também intensifica o risco de criação de tabelas estruturalmente semelhantes entre os domínios, gerando redun dâncias que comprometem a governança, a rastreabilidade e a eficiência dos recursos. Esta dis sertação apresenta uma metodologia para detecção de redundâncias estruturais em arquiteturas de dados distribuídas, fundamentada na modelagem de tabelas como grafos direcionados e na aplicação de algoritmos de isomorfismo de subgrafos. Nesse contexto, três abordagens foram consideradas: o VF2, utilizado como referência consolidada na literatura; o Node Match, um algoritmo híbrido desenvolvido neste trabalho com função de pré-filtragem; e modelos super visionados baseados em redes neurais gráficas (GNN), aplicados à predição de isomorfismos. Comoparte das contribuições, também foi desenvolvida a ferramenta Isomera, em Python, res ponsável por operacionalizar a metodologia e permitir sua experimentação prática. A proposta organiza um ciclo de experimentação em quatro etapas: geração automatizada de cenários, apli cação dos algoritmos, validação humana supervisionada, necessária para mitigar falsos positi vos e assegurar confiabilidade, e avaliação quantitativa dos resultados. A ferramenta Isomera possibilita simular arquiteturas sintéticas ou baseadas em benchmarks consolidados, como o TPC-DS, além de oferecer recursos para a execução controlada de experimentos, a compara ção entre algoritmos e a análise de métricas como tempo de execução (ET), acurácia (ACC) e frequência de sucesso (SF). Dois estudos de caso ilustraram a aplicação da metodologia: o primeiro, utilizando VF2 e Node Match, e o segundo, incorporando redes neurais (GNN), que demonstraram ganhos de acurácia em cenários de maior complexidade, ainda que com maior custo computacional. Adicionalmente, esta dissertação contribui com um artefato científico e experimental que favorece a replicação de testes, a expansão modular com novos algoritmos e a análise sistemática de trade-offs entre performance e precisão. Ao unir flexibilidade, reproduti bilidade e análise crítica, o trabalho oferece uma base sólida para pesquisadores e profissionais que buscam aprimorar a governança de dados em arquiteturas distribuídas.","abstract_html":"A adoção do paradigma Data Mesh tem impulsionado a descentralização da posse de dados nas organizações, permitindo que cada domínio de negócio gerencie seus próprios produtos de dados. Embora essa abordagem aumente a autonomia e a flexibilidade, ela também intensifica o risco de criação de tabelas estruturalmente semelhantes entre os domínios, gerando redun dâncias que comprometem a governança, a rastreabilidade e a eficiência dos recursos. Esta dis sertação apresenta uma metodologia para detecção de redundâncias estruturais em arquiteturas de dados distribuídas, fundamentada na modelagem de tabelas como grafos direcionados e na aplicação de algoritmos de isomorfismo de subgrafos. Nesse contexto, três abordagens foram consideradas: o VF2, utilizado como referência consolidada na literatura; o Node Match, um algoritmo híbrido desenvolvido neste trabalho com função de pré-filtragem; e modelos super visionados baseados em redes neurais gráficas (GNN), aplicados à predição de isomorfismos. Comoparte das contribuições, também foi desenvolvida a ferramenta Isomera, em Python, res ponsável por operacionalizar a metodologia e permitir sua experimentação prática. A proposta organiza um ciclo de experimentação em quatro etapas: geração automatizada de cenários, apli cação dos algoritmos, validação humana supervisionada, necessária para mitigar falsos positi vos e assegurar confiabilidade, e avaliação quantitativa dos resultados. A ferramenta Isomera possibilita simular arquiteturas sintéticas ou baseadas em benchmarks consolidados, como o TPC-DS, além de oferecer recursos para a execução controlada de experimentos, a compara ção entre algoritmos e a análise de métricas como tempo de execução (ET), acurácia (ACC) e frequência de sucesso (SF). Dois estudos de caso ilustraram a aplicação da metodologia: o primeiro, utilizando VF2 e Node Match, e o segundo, incorporando redes neurais (GNN), que demonstraram ganhos de acurácia em cenários de maior complexidade, ainda que com maior custo computacional. Adicionalmente, esta dissertação contribui com um artefato científico e experimental que favorece a replicação de testes, a expansão modular com novos algoritmos e a análise sistemática de trade-offs entre performance e precisão. Ao unir flexibilidade, reproduti bilidade e análise crítica, o trabalho oferece uma base sólida para pesquisadores e profissionais que buscam aprimorar a governança de dados em arquiteturas distribuídas.","abstract_has_math":false,"creators":["OLIVEIRA, Cayo Felipe Lopes de"],"institution":"Universidade Federal de Pernambuco","degree_name":null,"degree_level":null,"degree_discipline":null,"degree_department":null,"school":null,"contributors":[],"advisors":["DANTAS, Jamilson Ramalho"],"committee_chairs":[],"committee_members":[],"year":2025,"date_issued":"2025-07-31","date_published":"2025-07-31","updated_at":"2026-07-24T01:18:37Z","subjects":["Data Mesh","Grafos","Redundância de dados","Algoritmo de grafos","Isomera"],"languages":["por"],"rights":["openAccess"],"rights_urls":["https://creativecommons.org/licenses/by-nc-nd/4.0/"],"identifier_entries":[]},"links":{"outbound_url":"https://repositorio.ufpe.br/handle/123456789/67304","outbound_label":"Repository record","outbound_source":"dc:identifier.uri"},"metadata_groups":[{"id":"people","label":"People","entries":[{"key":"dc:contributor.advisor","label":"Advisor","values":["DANTAS, Jamilson Ramalho"]},{"key":"dc:creator","label":"Author","values":["OLIVEIRA, Cayo Felipe Lopes de"]}]},{"id":"academic_context","label":"Academic Context","entries":[{"key":"dc:date.accessioned","label":"Dc Date Accessioned","values":["2025-12-19T13:46:21Z"]},{"key":"dc:date.available","label":"Dc Date Available","values":["2025-12-19T13:46:21Z"]},{"key":"dc:date.issued","label":"Date","values":["2025-07-31"]},{"key":"dc:publisher","label":"Institution","values":["Universidade Federal de Pernambuco"]},{"key":"dc:type","label":"Dc Type","values":["masterThesis"]}]},{"id":"subjects_keywords","label":"Subjects and Keywords","entries":[{"key":"dc:subject","label":"Dc Subject","values":["Data Mesh","Grafos","Redundância de dados","Algoritmo de grafos","Isomera"]}]},{"id":"language_rights","label":"Language and Rights","entries":[{"key":"dc:language.iso","label":"Language (ISO)","values":["por"]},{"key":"dc:rights","label":"Dc Rights","values":["openAccess"]},{"key":"dc:rights.uri","label":"Rights URI","values":["https://creativecommons.org/licenses/by-nc-nd/4.0/"]}]},{"id":"identifiers","label":"Identifiers","entries":[{"key":"dc:identifier.uri","label":"Identifier URI","values":["https://repositorio.ufpe.br/handle/123456789/67304"]}]},{"id":"additional","label":"Additional Metadata","entries":[{"key":"dc:description.abstract","label":"Abstract","values":["A adoção do paradigma Data Mesh tem impulsionado a descentralização da posse de dados nas organizações, permitindo que cada domínio de negócio gerencie seus próprios produtos de dados. Embora essa abordagem aumente a autonomia e a flexibilidade, ela também intensifica o risco de criação de tabelas estruturalmente semelhantes entre os domínios, gerando redun dâncias que comprometem a governança, a rastreabilidade e a eficiência dos recursos. Esta dis sertação apresenta uma metodologia para detecção de redundâncias estruturais em arquiteturas de dados distribuídas, fundamentada na modelagem de tabelas como grafos direcionados e na aplicação de algoritmos de isomorfismo de subgrafos. Nesse contexto, três abordagens foram consideradas: o VF2, utilizado como referência consolidada na literatura; o Node Match, um algoritmo híbrido desenvolvido neste trabalho com função de pré-filtragem; e modelos super visionados baseados em redes neurais gráficas (GNN), aplicados à predição de isomorfismos. Comoparte das contribuições, também foi desenvolvida a ferramenta Isomera, em Python, res ponsável por operacionalizar a metodologia e permitir sua experimentação prática. A proposta organiza um ciclo de experimentação em quatro etapas: geração automatizada de cenários, apli cação dos algoritmos, validação humana supervisionada, necessária para mitigar falsos positi vos e assegurar confiabilidade, e avaliação quantitativa dos resultados. A ferramenta Isomera possibilita simular arquiteturas sintéticas ou baseadas em benchmarks consolidados, como o TPC-DS, além de oferecer recursos para a execução controlada de experimentos, a compara ção entre algoritmos e a análise de métricas como tempo de execução (ET), acurácia (ACC) e frequência de sucesso (SF). Dois estudos de caso ilustraram a aplicação da metodologia: o primeiro, utilizando VF2 e Node Match, e o segundo, incorporando redes neurais (GNN), que demonstraram ganhos de acurácia em cenários de maior complexidade, ainda que com maior custo computacional. Adicionalmente, esta dissertação contribui com um artefato científico e experimental que favorece a replicação de testes, a expansão modular com novos algoritmos e a análise sistemática de trade-offs entre performance e precisão. Ao unir flexibilidade, reproduti bilidade e análise crítica, o trabalho oferece uma base sólida para pesquisadores e profissionais que buscam aprimorar a governança de dados em arquiteturas distribuídas."]},{"key":"dc:title","label":"Title","values":["Uma metodologia baseada em grafos para detecção de redundância estrutural em Arquiteturas Data Mesh"]}]}],"canonical_facts":{"dc:contributor.advisor":["DANTAS, Jamilson Ramalho"],"dc:creator":["OLIVEIRA, Cayo Felipe Lopes de"],"dc:date.accessioned":["2025-12-19T13:46:21Z"],"dc:date.available":["2025-12-19T13:46:21Z"],"dc:date.issued":["2025-07-31"],"dc:description.abstract":["A adoção do paradigma Data Mesh tem impulsionado a descentralização da posse de dados nas organizações, permitindo que cada domínio de negócio gerencie seus próprios produtos de dados. Embora essa abordagem aumente a autonomia e a flexibilidade, ela também intensifica o risco de criação de tabelas estruturalmente semelhantes entre os domínios, gerando redun dâncias que comprometem a governança, a rastreabilidade e a eficiência dos recursos. Esta dis sertação apresenta uma metodologia para detecção de redundâncias estruturais em arquiteturas de dados distribuídas, fundamentada na modelagem de tabelas como grafos direcionados e na aplicação de algoritmos de isomorfismo de subgrafos. Nesse contexto, três abordagens foram consideradas: o VF2, utilizado como referência consolidada na literatura; o Node Match, um algoritmo híbrido desenvolvido neste trabalho com função de pré-filtragem; e modelos super visionados baseados em redes neurais gráficas (GNN), aplicados à predição de isomorfismos. Comoparte das contribuições, também foi desenvolvida a ferramenta Isomera, em Python, res ponsável por operacionalizar a metodologia e permitir sua experimentação prática. A proposta organiza um ciclo de experimentação em quatro etapas: geração automatizada de cenários, apli cação dos algoritmos, validação humana supervisionada, necessária para mitigar falsos positi vos e assegurar confiabilidade, e avaliação quantitativa dos resultados. A ferramenta Isomera possibilita simular arquiteturas sintéticas ou baseadas em benchmarks consolidados, como o TPC-DS, além de oferecer recursos para a execução controlada de experimentos, a compara ção entre algoritmos e a análise de métricas como tempo de execução (ET), acurácia (ACC) e frequência de sucesso (SF). Dois estudos de caso ilustraram a aplicação da metodologia: o primeiro, utilizando VF2 e Node Match, e o segundo, incorporando redes neurais (GNN), que demonstraram ganhos de acurácia em cenários de maior complexidade, ainda que com maior custo computacional. Adicionalmente, esta dissertação contribui com um artefato científico e experimental que favorece a replicação de testes, a expansão modular com novos algoritmos e a análise sistemática de trade-offs entre performance e precisão. Ao unir flexibilidade, reproduti bilidade e análise crítica, o trabalho oferece uma base sólida para pesquisadores e profissionais que buscam aprimorar a governança de dados em arquiteturas distribuídas."],"dc:identifier.uri":["https://repositorio.ufpe.br/handle/123456789/67304"],"dc:language.iso":["por"],"dc:publisher":["Universidade Federal de Pernambuco"],"dc:rights":["openAccess"],"dc:rights.uri":["https://creativecommons.org/licenses/by-nc-nd/4.0/"],"dc:subject":["Data Mesh","Grafos","Redundância de dados","Algoritmo de grafos","Isomera"],"dc:title":["Uma metodologia baseada em grafos para detecção de redundância estrutural em Arquiteturas Data Mesh"],"dc:type":["masterThesis"]},"updated_at":"2026-07-24T01:18:37Z"}