指南奇异值分解协同过滤.doc

奇异值分解协同过滤指南 Chih-Chao Ma 计算机科学,国立台湾大学,台北,台湾系 摘要 作为电子商务市场爆炸性的增长,它是重要的,以提供用于各种消费者定制的建议。协同过滤是模型和分析的偏好的客户,并给出适当的建议的一项重要技术。奇异值分解(SVD)是用于协同作业共同过滤流行的算法之一。然而,直接采用传统的奇异值分解算法协同过滤可能会导致性能不佳。在这份报告中,我们讨论了初学者可能会遇到的问题和当前有效的SVD变式协同过滤。 1 介绍 协同过滤是通过大量用户的口味给出信息的集合预测用户的偏好和利益的技术。它的基本假设是谁同意在过去人们也会同意,在未来。协同过滤可以用于一个推荐系统可以自动提示用户他/她的优选产品。 1.1 问题定义 假设一个数据库收集的m个对象作为数字形式的分数N个用户的喜好。例如,用户可以得分电影,他或她已经观看由1评级 - 5颗星。通常情况下,用户不进球数据库中的所有对象。此外,一些用户可能会进球多的对象,但其他人只是入球数。 设V∈R N * M是数据库中收集的分数的矩阵,并N * M 我∈{0,1??} 是其指示灯,这样我IJ=1,如果对象j被拿下由用户I 和0,如果得分缺失。在大多数情况下,V是稀疏和不平衡,使得分数为每个用户或对象的数量不相等的大方差。单位为V工作中存在的成绩作为协同过滤的训练数据算法,以及在目标是预测在数据库中缺少的分数。让A∈读

文档评论(0)

1亿VIP精品文档

相关文档