Mapeamento e Detecção de Indicadores de Comprometimento em Relatórios de Threat Intelligence

  • Charllynson Carvalho Caxias UFPel
  • Brenda Salenave Santana UFPel

Resumo


A crescente sofisticação dos ataques cibernéticos exige soluções automatizadas e precisas para a extração de Indicadores de Comprometimento (IoCs) contidos em relatórios de Threat Intelligence. Este trabalho propõe uma abordagem híbrida baseada em Expressões Regulares (Regex) e Reconhecimento de Entidades Nomeadas (NER) para a identificação de IoCs em textos não estruturados. A metodologia combina a validação estrutural de padrões sintáticos à análise contextual para detectar artefatos como endereços IP, URLs e hashes, inclusive sob formatos ofuscados. Avaliado sobre um corpus real de relatórios de CTI, o pipeline desenvolvido demonstrou que a convergência entre regras rígidas e modelos contextuais reduz significativamente os falsos positivos e amplia a precisão da contextualização dos dados extraídos.

Referências

Alam, M. T., Bhusal, D., Park, Y., and Rastogi, N. (2022). Cyner: A python library for cybersecurity named entity recognition.

Anishnama (2023). Understanding bidirectional lstm for sequential data processing.

Feng, X., He, S., Wei, X., Liu, R., Yue, H., and Wang, X. (2025). Prompt-bart: A named entity recognition model applied to cyber threat intelligence.

Filho, S. J., Gabriel, P., and Miani, R. (2023). Extração e análise de indicadores de comprometimento (iocs) em fóruns da dark web. In Anais do XXIII Simpósio Brasileiro de Segurança da Informação e de Sistemas Computacionais, pages 349–362, Porto Alegre, RS, Brasil. SBC.

Fujii, S., Kawaguchi, N., Shigemoto, T., and Yamauchi, T. (2023). Extracting and analyzing cybersecurity named entity and its relationship with noncontextual iocs from unstructured text of cti sources. Journal of Information Processing, 31:578–590.

Gao, P., Liu, X., Choi, E., Ma, S., Yang, X., and Song, D. (2024). Threatkg: An ai-powered system for automated open-source cyber threat intelligence gathering and management. In Proceedings of the 1st ACM Workshop on Large AI Systems and Models with Privacy and Safety Analysis, LAMPS ’24, page 1–12, New York, NY, USA. Association for Computing Machinery.

Jiang, Y., Hu, H., Li, Y., Li, F., Zhao, C., Chen, C., and Liu, Y. (2025). A zero-shot self-improving ner method for cyber threat intelligence via knowledge injection. Cybersecurity, 8.

Jo, H., Lee, Y., and Shin, S. (2022). Vulcan: Automatic extraction and analysis of cyber threat intelligence from unstructured text. Computers & Security, 120:102763.

Long, Z., Tan, L., Zhou, S., He, C., and Liu, X. (2019). Collecting indicators of compromise from unstructured text of cybersecurity articles using neural-based sequence labelling. In 2019 International Joint Conference on Neural Networks (IJCNN), pages 1–8.

Mouiche, I. and Saad, S. (2025a). Entity and relation extractions for threat intelligence knowledge graphs. Computers & Security, 148:104120.

Mouiche, I. and Saad, S. (2025b). Tijere: A novel threat intelligence joint extraction model based on analyst expert knowledge. Knowledge-Based Systems, 329:114346.

Nakayama, H. (2018). Get started with doccano.

Nogueira, D. (2025). N8n: O que É, como funciona e como instalar.

Team, M. D. S. R. (2025). From unstructured data to actionable intelligence: Using machine learning for threat intelligence.

Team, S. (2023). Deep learning for nlp - an overview.

Tho, N. D., Hieu, N. T., Tran, N. N. B., and Anh, N. P. (2023). Extracting multiple relations between entities from unstructured threat intelligence reports. Journal of Science and Technology on Information security, 3(20):5–13.
Publicado
01/09/2026
CAXIAS, Charllynson Carvalho; SANTANA, Brenda Salenave. Mapeamento e Detecção de Indicadores de Comprometimento em Relatórios de Threat Intelligence. In: WORKSHOP DE TRABALHOS DE INICIAÇÃO CIENTÍFICA E DE GRADUAÇÃO - SIMPÓSIO BRASILEIRO DE CIBERSEGURANÇA (SBSEG), 26. , 2026, Armação dos Búzios/RJ. Anais [...]. Porto Alegre: Sociedade Brasileira de Computação, 2026 . p. 532-542. DOI: https://doi.org/10.5753/sbseg_estendido.2026.29364.

Artigos mais lidos do(s) mesmo(s) autor(es)