基于支持向量机的垃圾邮件过滤技术研究-计算机应用技术专业论文.docxVIP

  • 3
  • 0
  • 约6.55万字
  • 约 77页
  • 2019-03-23 发布于上海
  • 举报

基于支持向量机的垃圾邮件过滤技术研究-计算机应用技术专业论文.docx

西华大学硕士学位论文基于支持向量机的垃圾邮件过滤技术研究 西华大学硕士学位论文 基于支持向量机的垃圾邮件过滤技术研究 计算机应用技术专业 研究生杨霁琳指导教师彭宏 摘 要 随着互联网的快速普及与发展,垃圾邮件的泛滥已成为一大难题,它不 仅损害了电子邮件用户的合法权益,威胁着互联网信息安全,而且每年给国 民经济造成数十亿元的巨大损失.,因此研究有效的垃圾邮件过滤方法具有重 要的现实意义。 支持向量机(svM)是一种建立在统计学习理论之上的机器学习方法. 其最大特点是根据结构风险化最小原则,尽量提高学习机的泛化能力,即由 有限的训练样本得到小的误差仍然能够保证对独立的测试集保持小的误差. 另外,由于支持向量机算法是一个凸优化问题,所以局部最优解一定是全局 最优解.它已被成功地运用于许多分类问题的研究. 我们注意到。目前已有机器学习方法在进行垃圾邮件过滤时,一封邮件 都是被确定地分类为垃圾邮件或者是合法邮件.但实际上,针对邮件服务器 端的多个用户,一封邮件是垃圾邮件还是合法邮件,不同的用户有不同的认 识,而且还有程度的问题,因此对邮件过滤的处理应被视为不确定信息的处 理问题。 在本文的研究中,我们把这些不确定性形式化,即合法邮件被认为是邮 件样本集上的模糊概念.它的模糊函数是通过聚合互联网上用户的评价信息 所获得的,而这个聚合算子采用有序加权平均算子.由于每封邮件训练样本 都有一个合法邮

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档