Aprendizaje por defensa reactiva: el nuevo modelo de entrenamiento contra malware

Contenido principal del artículo

Bernal Rojas Villalobos
César Rodríguez Bravo

Resumen

Este artículo propone un nuevo método de defensa en ciberseguridad utilizando inteligencia artificial, que puede ser aplicado en diferentes entornos, desde equipos de escritorio (personales y empresariales), hasta equipos móviles (tabletas, laptops e incluso celulares). Los sistemas antimalware o antivirus tradicionales funcionan de manera determinística (es decir, basados en reglas), mientras que los cibercriminales aparecen con técnicas cada vez más creativas para burlar estos sistemas. En este artículo se propone el diseño de una arquitectura de inteligencia artificial capaz de detectar un código malicioso mediante aprendizaje automático, con la capacidad de identificar intentos creativos de burlar los sistemas de seguridad. Esta arquitectura se basa en el entrenamiento de dos inteligencias artificiales, una maliciosa o atacante (hacker) y otra defensiva. El entrenamiento de ambos modelos se realiza mediante aprendizaje por refuerzo con Q-Learning y redes neuronales convolucionales, respectivamente. La red neuronal atacante aprenderá mediante aprendizaje por refuerzo a ejecutar los métodos más utilizados por los hackers para burlar los sistemas antivirus o antimalware, mientras que el modelo defensor hará uso de Deep Learning para convertir los archivos binarios maliciosos en imágenes, y así poder entrenarse para identificar los patrones del malware y cualquier otra variante generada por el atacante.

Detalles del artículo

Sección

Investigaciones

Biografía del autor/a

Bernal Rojas Villalobos, LEAD University

Profesor

César Rodríguez Bravo, LEAD University

Profesor

Cómo citar

Aprendizaje por defensa reactiva: el nuevo modelo de entrenamiento contra malware. (2021). Logos, 2(1), 52-67. https://publicacionesulead.kohahosting.info/index.php/Logos/article/view/74

Referencias

[1] Saxe, J. y Berlin, K. (2015). Deep neural network based malware detection using two dimensional binary program features. InMalicious and Unwanted Software (MALWARE). 2015 10th International Conference on, pp. 11-20. IEEE.

[2] Nataraj, L.; Karthikeyan, S.; Jacob, G. y Manjunath, B. (2011). Malware Images: Visualization and Automatic Classification. 10.1145/2016904.2016908.

[3] Silver, D., Huang, A., Maddison, C. et al. (2016). Mastering the game of Go with deep neural networks and tree search. Nature 529, 484-489: https://doi.org/10.1038/nature16961.

[4] Massimo Zennaro, F. y Erdodi, L. (2020). Modeling Penetration Testing with Reinforcement Learning Using Capture-the-Flag Challenges and Tabular Q-Learning. Recuperado de: http://arxiv.org/abs/2005.12632 arXiv:2005.12632.

[5] Anderson, H.Y.; Kharkar, A.; Filar, B.; Evans, D. y Roth, P. (2018). Learning to Evade Static PE Machine Learning Malware Models via Reinforcement Learning. Recuperado: http://arxiv.org/abs/1801.08917 arXiv:1801.08917.

[6] Thanh Thi, N. y Vijay Janapa, R. (2019). Deep Reinforcement Learning for Cyber Security. Recuperado de: http://arxiv.org/abs/1906.05799 arXiv:1906.05799.

[7] VirusTotal.com. (s.f.). Recuperado de: https://www.virustotal.com/gui/.

Artículos similares

También puede Iniciar una búsqueda de similitud avanzada para este artículo.