SVM拉格朗日对偶问题最优间隔分类器.docVIP

SVM拉格朗日对偶问题最优间隔分类器.doc

  1. 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
  2. 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  3. 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  4. 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  5. 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  6. 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  7. 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
SVM拉格朗日对偶问题最优间隔分类器

最优间隔分类器(optimal margin classifier) ??? 重新回到SVM的优化问题: ???? ??? 我们将约束条件改写为: ???? ??? 从KKT条件得知只有函数间隔是1(离超平面最近的点)的线性约束式前面的系数,也就是说这些约束式,对于其他的不在线上的点(),极值不会在他们所在的范围内取得,因此前面的系数.注意每一个约束式实际就是一个训练样本。 ??? 看下面的图: ??? 实线是最大间隔超平面,假设×号的是正例,圆圈的是负例。在虚线上的点就是函数间隔是1的点,那么他们前面的系数,其他点都是。这三个点称作支持向量。构造拉格朗日函数如下: ??? ???? ??? 注意到这里只有没有是因为原问题中没有等式约束,只有不等式约束。 ??? 下面我们按照对偶问题的求解步骤来一步步进行, ???? ??? 首先求解的最小值,对于固定的,的最小值只与w和b有关。对w和b分别求偏导数。 ???? ???? ??? 并得到 ???? ??? 将上式带回到拉格朗日函数中得到,此时得到的是该函数的最小值(目标函数是凸函数) ??? 代入后,化简过程如下: ?????   最后得到 ???? 由于最后一项是0,因此简化为 ???? ??? 这里我们将向量内积表示为 ??? 此时的拉格朗日函数只包含了变量。然而我们求出了才能得到w和b。 ??? 接着是极大化的过程, ??? 前面提到过对偶问题和原问题满足的几个条件,首先由于目标函数和线性约束都是凸函数,而且这里不存在等式约束h。存在w使得对于所有的i,。因此,一定存在使得是原问题的解,是对偶问题的解。在这里,求就是求了。 ??? 如果求出了,根据即可求出w(也是,原问题的解)。然后 ???? ??? 即可求出b。即离超平面最近的正的函数间隔要等于离超平面最近的负的函数间隔。 ??? 关于上面的对偶问题如何求解,将留给下一篇中的SMO算法来阐明。 ??? 这里考虑另外一个问题,由于前面求解中得到 ???? ??? 我们通篇考虑问题的出发点是,根据求解得到的,我们代入前式得到 ???? ??? 也就是说,以前新来的要分类的样本首先根据w和b做一次线性运算,然后看求的结果是大于0还是小于0,来判断正例还是负例。现在有了,我们不需要求出w,只需将新来的样本和训练数据中的所有样本做内积和即可。那有人会说,与前面所有的样本都做运算是不是太耗时了?其实不然,我们从KKT条件中得到,只有支持向量的,其他情况。因此,我们只需求新来的样本和支持向量的内积,然后运算即可。这种写法为下面要提到的核函数(kernel)做了很好的铺垫。这是上篇,先写这么多了。

文档评论(0)

kabudou + 关注
实名认证
文档贡献者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档