机器学习技术探测高级恶意软件 (Detection of Advanced Malware by Machine Learning Techniques)

In today's digital world most of the anti-malware tools are signature based which is ineffective to detect advanced unknown malware viz. metamorphic malware. In this paper, we study the frequency of opcode occurrence to detect unknown malware by using machine learning technique. For the purpose, we have used kaggle Microsoft malware classification challenge dataset. The top 20 features obtained from fisher score, information gain, gain ratio, chi-square and symmetric uncertainty feature selection methods are compared. We also studied multiple classifier available in WEKA GUI based machine learning tool and found that five of them (Random Forest, LMT, NBT, J48 Graft and REPTree) detect malware with almost 100% accuracy.

翻译：在当今的数字世界中,大多数防疟工具都以签名为基础,无法有效检测出先进的未知恶意软件,即变形的恶意软件。在本文中,我们研究了使用机器学习技术检测未知恶意软件的代码发生频率。为此目的,我们使用了卡格格·微软恶意软件分类挑战数据集。比较了从渔获分、信息收益、收益率、奇方和对称不确定性特征选择方法中获得的最前20个特征。我们还研究了WEKA GUI基于WEKA GUI的机器学习工具中的多个分类器,发现其中5个(兰多姆森林、LMT、NBT、J48 Graft和REPTree)以近100%的精确度检测了恶意软件。

相关内容

Machine Learning

关注 2245

机器学习（Machine Learning）是一个研究计算学习方法的国际论坛。该杂志发表文章，报告广泛的学习方法应用于各种学习问题的实质性结果。该杂志的特色论文描述研究的问题和方法，应用研究和研究方法的问题。有关学习问题或方法的论文通过实证研究、理论分析或与心理现象的比较提供了坚实的支持。应用论文展示了如何应用学习方法来解决重要的应用问题。研究方法论文改进了机器学习的研究方法。所有的论文都以其他研究人员可以验证或复制的方式描述了支持证据。论文还详细说明了学习的组成部分，并讨论了关于知识表示和性能任务的假设。官网地址：http://dblp.uni-trier.de/db/journals/ml/

【干货书】真实机器学习，264页pdf，Real-World Machine Learning

专知会员服务

115+阅读 · 2020年4月5日