- 0
- 0
- 约7.83千字
- 约 9页
- 2026-08-04 发布于广东
- 举报
第PAGE页共NUMPAGES页
基于关联规则、RFM聚类与协同过滤的电商用户行为分析研究
1.数据分析步骤
1.1数据获取
本课程设计选取UCI机器学习仓库的OnlineRetail数据集作为分析对象。该数据集记录了英国某在线零售企业在2010年12月1日至2011年12月9日期间的全部交易流水,共541909条原始记录、8个属性字段[1]。字段包括:InvoiceNo(发票编号)、StockCode(商品编码)、Description(商品描述)、Quantity(数量)、InvoiceDate(交易时间)、UnitPrice(单价)、CustomerID(客户编号)和Country(国家)。
该数据集是电子商务分析领域最为广泛使用的公开数据集之一,数据量大、维度丰富,涵盖了交易时间、商品信息、客户身份和地理区域等关键维度,天然适合开展关联规则挖掘、客户分群、推荐系统和时间序列分析等多种数据挖掘任务[2]。数据集无人工标注偏差,真实反映了实际电商运营中的交易模式和客户行为规律。
图1OnlineRetail数据概览(商品、国家、单价、购买数量分布)
1.2数据预处理
原始数据包含多种数据质量问题,需要经过系统性的预处理方可投入建模分析。真实商业数据往往比教科书中的示例数据集更为脏乱,预处理工作是数据挖掘流程中最耗时但也最关键的基础环节,直接决定了后
原创力文档

文档评论(0)