Análise de Desempenho da Verificação de Convergência de Sequências Numéricas com OpenMP e CUDA
Resumo
Este trabalho analisa implementações sequencial, OpenMP e CUDA para verificação computacional da conjectura de convergência ao ciclo 3, 7, 15, segundo regras de transformação baseadas em primalidade, divisibilidade e paridade. Com entradas de até 109, OpenMP (8 threads) atingiu speedup de 5,13× e CUDA alcançou 69,09×, evidenciando a viabilidade do paralelismo em verificações de larga escala.
Referências
Dagum, L. and Menon, R. (1998). Openmp: an industry standard api for shared-memory programming. IEEE Computational Science and Engineering, 5(1):46–55.
Gimenez, H., Gonçalves, R., and Filho, J. F. (2025). Desempenho da multiplicação de matrizes em sistemas multicore com pthreads, openmp, blocking, simd e blas. In Anais da XVI Escola Regional de Alto Desempenho de São Paulo, pages 38–41, Porto Alegre, RS, Brasil. SBC.
Nickolls, J., Buck, I., Garland, M., and Skadron, K. (2008). Scalable parallel programming with cuda. Queue, 6:40–53.
OpenMP Architecture Review Board (2020). OpenMP Application Program Interface Version 5.1.
Tao, T. (2022). Almost all orbits of the collatz map attain almost bounded values. Forum of Mathematics, Pi, 10:e12.
