PhyloTreeMiner: Integração de Dados Heterogêneos e Consultas em Grafos para Mineração de Padrões Filogenéticos

  • João Vitor Moraes Universidade Federal Fluminense (UFF)
  • Layse Gomes Castro Universidade Federal Fluminense (UFF)
  • Isabel Rosseti Universidade Federal Fluminense (UFF)
  • Daniel de Oliveira Universidade Federal Fluminense (UFF)

Resumo


A análise filogenética permite compreender relações evolutivas, mas diferentes métodos de inferência frequentemente geram múltiplas árvores a partir do mesmo conjunto de dados. Este artigo apresenta o PhyloTreeMiner, um sistema de mineração de padrões filogenéticos a partir de múltiplas árvores filogenéticas. A abordagem modela o problema como a mineração de itemsets frequentes maximais, identificando subárvores recorrentes que representam relações evolutivas robustas. Os resultados são enriquecidos e armazenados em um grafo de conhecimento, permitindo consultas analíticas e exploração interativa.
Palavras-chave: Mineração de Padrões Filogenéticos, Árvores Filogenéticas, Grafos de Conhecimento, Integração de Dados

Referências

Agrawal, R. and Srikant, R. (1994). Fast algorithms for mining association rules. In Proceedings of the 20th VLDB, pages 487–499.

Baker, K. S., Jauneikaite, E., et al. (2023). Genomics for public health and international surveillance of antimicrobial resistance. The Lancet Microbe, 4(12):e1047–e1055.

Deepak, A., Fernández-Baca, D., et al. (2014). Evominer: frequent subtree mining in phylogenetic databases. Knowl. Inf. Syst., 41(3):559–590.

dos Santos, V., de Oliveira, D., et al. (2025). Mind the context: Enriching knowledge graphs with rules and mappings. In IEEE ICKG, Cyprus, 2025, pages 59–66. IEEE.

Felsenstein, J. (2004). Inferring Phylogenies. Sinauer Associates.

Grahne, G. and Zhu, J. (2003). Efficiently using prefix-trees in mining frequent itemsets. In Proc. of FIMI ’03, CEUR Workshop Proceedings.

Marx, V. (2013). The big challenges of big data. Nature, 498(7453):255–260.

Metzker, M. L. (2010). Sequencing technologies — the next generation. Nature Reviews Genetics, 11(1):31–46.

Ocaña, K. A. C. S., de Oliveira, D., et al. (2012). Discovering drug targets for neglected diseases using a pharmacophylogenomic cloud workflow. In 8th IEEE e-Science, pages 1–8. IEEE Computer Society.

O’Leary, N. A., Cox, E., et al. (2024). Exploring and retrieving sequence and metadata for species across the tree of life with ncbi datasets. Scientific Data, 11(1):732.

Zadra, N., Rizzoli, A., and Rota-Stabelli, O. (2024). Comprehensive phylogenomic analysis of zika virus: Insights into its origin, past evolutionary dynamics, and global spread. Virus Research, 350:199490. Epub 2024 Nov 8.
Publicado
08/09/2026
MORAES, João Vitor; CASTRO, Layse Gomes; ROSSETI, Isabel; DE OLIVEIRA, Daniel. PhyloTreeMiner: Integração de Dados Heterogêneos e Consultas em Grafos para Mineração de Padrões Filogenéticos. In: DEMONSTRAÇÕES E APLICAÇÕES - SIMPÓSIO BRASILEIRO DE BANCO DE DADOS (SBBD), 41. , 2026, São Carlos/SP. Anais [...]. Porto Alegre: Sociedade Brasileira de Computação, 2026 . p. 167-172. DOI: https://doi.org/10.5753/sbbd_estendido.2026.249350.