Aprendizaje por defensa reactiva: el nuevo modelo de entrenamiento contra malware
Contenido principal del artículo
Resumen
Este artículo propone un nuevo método de defensa en ciberseguridad utilizando inteligencia artificial, que puede ser aplicado en diferentes entornos, desde equipos de escritorio (personales y empresariales), hasta equipos móviles (tabletas, laptops e incluso celulares). Los sistemas antimalware o antivirus tradicionales funcionan de manera determinística (es decir, basados en reglas), mientras que los cibercriminales aparecen con técnicas cada vez más creativas para burlar estos sistemas. En este artículo se propone el diseño de una arquitectura de inteligencia artificial capaz de detectar un código malicioso mediante aprendizaje automático, con la capacidad de identificar intentos creativos de burlar los sistemas de seguridad. Esta arquitectura se basa en el entrenamiento de dos inteligencias artificiales, una maliciosa o atacante (hacker) y otra defensiva. El entrenamiento de ambos modelos se realiza mediante aprendizaje por refuerzo con Q-Learning y redes neuronales convolucionales, respectivamente. La red neuronal atacante aprenderá mediante aprendizaje por refuerzo a ejecutar los métodos más utilizados por los hackers para burlar los sistemas antivirus o antimalware, mientras que el modelo defensor hará uso de Deep Learning para convertir los archivos binarios maliciosos en imágenes, y así poder entrenarse para identificar los patrones del malware y cualquier otra variante generada por el atacante.
Detalles del artículo
Sección

Esta obra está bajo una licencia internacional Creative Commons Atribución-NoComercial-SinDerivadas 4.0.
Cómo citar
Referencias
[1] Saxe, J. y Berlin, K. (2015). Deep neural network based malware detection using two dimensional binary program features. InMalicious and Unwanted Software (MALWARE). 2015 10th International Conference on, pp. 11-20. IEEE.
[2] Nataraj, L.; Karthikeyan, S.; Jacob, G. y Manjunath, B. (2011). Malware Images: Visualization and Automatic Classification. 10.1145/2016904.2016908.
[3] Silver, D., Huang, A., Maddison, C. et al. (2016). Mastering the game of Go with deep neural networks and tree search. Nature 529, 484-489: https://doi.org/10.1038/nature16961.
[4] Massimo Zennaro, F. y Erdodi, L. (2020). Modeling Penetration Testing with Reinforcement Learning Using Capture-the-Flag Challenges and Tabular Q-Learning. Recuperado de: http://arxiv.org/abs/2005.12632 arXiv:2005.12632.
[5] Anderson, H.Y.; Kharkar, A.; Filar, B.; Evans, D. y Roth, P. (2018). Learning to Evade Static PE Machine Learning Malware Models via Reinforcement Learning. Recuperado: http://arxiv.org/abs/1801.08917 arXiv:1801.08917.
[6] Thanh Thi, N. y Vijay Janapa, R. (2019). Deep Reinforcement Learning for Cyber Security. Recuperado de: http://arxiv.org/abs/1906.05799 arXiv:1906.05799.
[7] VirusTotal.com. (s.f.). Recuperado de: https://www.virustotal.com/gui/.