* Data Mining * 建立新屬性 利用舊屬性將探勘所需的新屬性建立出來。 例如:整合後的資料只包含會員的生日,然而探勘時要用的屬性是會員的年齡,由於年齡可以從生日推算而出,因此可在此步驟建立出所需要的年齡屬性。(Derived Variables) * Data Mining * 資料正規化 Data Normalization 資料正規化的主要目的是將不同標準之下所記錄的資料轉換到同一個標準,以便提高分析時的準確度。資料的正規化會將資料重新分佈在一個較小而且特定的範圍內。 例如:台灣人民的平均所得遠高於菲律賓人。一個月賺一萬八千元台幣在台灣算是中低收入,然而在菲律賓,這卻是相當於三個大學教授的薪水。若是直接拿兩國人民的收入數字來做比較,便會產生不夠客觀的問題。 * Data Mining * 極值正規化 (1/2) 極值正規化的公式如下: 其中v為正規化前的數值,其範圍為[a, b]; v’為正規化後的數值,其範圍為[c, d]。 a b c d v v’ * Data Mining * 極值正規化 (2/2) 假設一般臺灣上班族的月收入範圍為[20000, 100000],而一般菲律賓上班族的月收入範圍為[2000, 10000];在台灣收入30000元相當於在菲律賓收入多少? v = 30000 a = 2
您可能关注的文档
最近下载
- 2025年苏教版高一化学苯环硝化反应专题试卷及解析.docx VIP
- 2025年无人机驾驶员执照飞行中数据链状态监控专题试卷及解析.pdf VIP
- DB33 公交渡口建设与管理规范.pdf VIP
- 县域消费扶贫与长效帮扶机制分析.pdf VIP
- 2026年抖音商家违规免处罚考试题目含答案.docx
- 2026执业药师继续教育答案(金航联)--24.零售药店质量体系的建立——质量活动.doc VIP
- TB10760-2021 高速铁路工程静态验收技术规范.pdf VIP
- Q_SH CG0139-2021采油用油井脱硫剂技术要求.pdf VIP
- 北京双高人才测评题.pdf
- 零售药店质量体系的建立——质量要素.doc VIP
原创力文档

文档评论(0)