- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
数据挖掘原理博士What is Data Mining?According to the Gartner Group, Data mining is the process of discovering meaningful new correlations, patterns and trends by sifting through large amounts of data stored in repositories, using pattern recognition technologies as well as statistical and mathematical techniques.Data mining refers to the work of discovering new and useful (business) knowledge from large real databases through a non-trivial process and using a sound methodology and multiple data processing and analytical techniques.Examples:Detect taxation fraud: not declaring all income for taxation;From the thousands of mobile phone customers, predict which customers are going to switch to a competitor .数据挖掘受多学科的影响 数据挖掘是一个交叉科学领域,受多个学科影响,包括数据库系统、统计、机器学习、可视化和信息科学。 一个比较正式的数据挖掘的定义高层次上的主动式自动发现方法,被称为发现驱动型知识发现。从数据中提取正确的、有用的、未知的和综合的信息并用它进行决策的过程。数据挖掘的相关学科是统计理论、数据库技术和人工智能。前Business Objects的Todd Rowe曾表示:“从技术上讲,甚至只要有完备的Excel数据就能用上BI。” 过程数据挖掘并不是一个装在软件包装盒中的工具可以简单的买到并运行在商业智能环境中,也不会自动开始产生值得注意的商业规律。正确的提取的信息应该是正确的,并且在统计上是重要的以支持有依据的决定。正确意味着确证性和完整性。不但需要从数据库中得到正确的客户,还希望得到所有正确的客户。这就需要原始数据和数据挖掘过程都具有正确性。有用的数据挖掘过程可能会传递正确的和重要的结果,但是这些知识必须是对商业有用的。如结果告诉你要在一个大量的渠道上多样化市场运作,这可能会无法办到。同样结果必须使你能抢在竞争对手之前行动。未知的数据挖掘要产生新的信息。如果过程只是传递一些无关紧要的结果,那么数据挖掘的商业动力就会消失。这就是区分验证和探索的性质。最小要求以上显示了数据挖掘最小要求,可以用它来评价数据挖掘是否对业务环境增加了附加的价值其他要求Why Data Mining?Gain an insight into business dataIdentify useful patterns, correlations and models from data automatically to answer questions like, Which customer is likely to churn in two months?Which customer is my cross sell target?What are the characteristics of my high spending and low spending customers?Data mining is a core technology of business intelligenceData mining is a core application of data warehousesData mining is the core technology of analytical CRMData mining is the core technology of online recommendation and personalization in e-commerceData mining has become a part of business function in many companiesData mining is regularly used in典型的数据挖掘系统结构 Verification-Driven Analysi
文档评论(0)