数据挖掘的价值.docx

  1. 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
  2. 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  3. 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
数据挖掘的价值:寿险行业数据挖掘应用分析 寿险是保险行业的一个重要分支,具有巨大的市场发展空间,因此,随着寿险市场的开 放、外资公司的介入,竞争逐步升级,群雄逐鹿己成定局。如何保持自身的核心竞争 力,使自己始终立于不败之地,是每个企业必须面对的问题。信息技 术的应用无疑是提 高企业竞争力的有效手段之一。寿险信息系统经过了多年的发展,己逐步成熟完善,并 积累了相当数量的数据资源,为数据挖掘提供了坚实的基础,而通过数据挖掘发现知 识,并用于科学决策越来越普遍受到寿险公司的重视。 数据挖掘 数据挖掘(Data Mining, DM是指从大量不完全的、有噪声的、模糊的、随机的数据 中,提取隐含在其中的、有用的信息和知识的过程。其表现形式为概念 (Concepts) 规则(Rules)、模式(Patterns)等形式。 目前业内己有很多成熟的数据挖掘方法论,为实际应用提供了理想的指导模型。 CRISP-DM( Cross-1 ndustry Sta ndard Process for Data Mining )就是公认的、较有 影响的方法论之一。CRISP-DMS调,DM不单是数据的组织或者呈现,也不仅是数据 分析和统计建模,而是一个从理解业务需求、寻求解决方案到接受实践检验的完整过 程。CRISP-DM将整个挖掘过程分为以下六个阶段:商业理解 (Business Understanding),数据理解(Data Understanding),数据准备(Data Preparation),建模(Modeling),评估(Evaluation)和发布(Deployment)o 商业理解就是对企业运作、业务流程和行业背景的了解;数据理解是对现有企业 应用系 统的了解;数据准备就是从企业大量数据中取出一个与要探索问题相关的样板数据子 集。建模是根据对业务问题的理解,在数据准备的基础上,选择一种 更为实用的挖掘模型,形成挖掘的结论。评估就是在实际中检验挖掘的结论,如 果达到 了预期的效果,就可将结论发布。在实际项目中, CRISP-DM模型中的数 据理解、数据准备、建模、评估并不是单向运作的,而是一个多次反复、多次调整、不 断修订完善的过程。 行业数据挖掘经过多年的系统运营,寿险公司己积累了相当可观的保单信息、客户信 息、交易信息、财务信息等,也出现了超大规模的数据库系统。同时,数据集中为原有 业 务水平的提升以及新业务的拓展提供了条件,也为数据挖掘提供了丰厚的土壤。 根据CRISP-DM莫型,数据挖掘首先应该做的是对业务的理解、寻找数据挖掘的 目标和问题。这些问题包括:代理人的甄选、欺诈识别以及市场细分等,其中市 场细分对企业制定经营战略具有极高的指导意义,它是关系到企业能否生存与发展、企 业市场营销战略制定与实现的首要问题。 针对寿险经营的特点,我们可以从不同的角度对客户群体进行分类归纳,从而形成各种 客户分布统计,作为管理人员决策的依据。从寿险产品入手,分析客户对不同险种的偏 好程度,指导代理人进行重点推广,是比较容易实现的挖掘思路。 由于国内经济发展状况不同,各省差异较大,因此必须限定在一个经济水平相当的区域 进行分析数据的釆样。同时,市场波动也是必须要考虑的问题,一个模型从建立到废弃 有一个生命周期,周期根据模型的适应性和命中率确定,因此模型需要不断修订。 挖掘系统架构 挖掘系统包括规则生成子系统和应用评估子系统两个部分 规则生成子系统主要完成根据数据仓库提供的保单历史数据, 统计并产生相关规 律,并输出相关结果。具体包括数据抽取转换、挖掘数据库建立、建模(其中包括了参 数设置)、模型评估、结果发布。发布的对象是高层决策者,同时将模型提交给应用评 估子系统?根据效果每月动态生成新的模型O 应用评估子系统可以理解为生产系统中的挖掘代理程序,根据生成子系统产生的规则按 照一定的策略对保单数据进行非类预测。通过系统的任务计划对生产数据产生评估指 标。具体包括核心业务系统数据自动转入数据平台、规则实时评估、评估结果动态显 示、实际效果评估。规则评估子系统根据规则进行检测。经过一段时间的检测,可利用 规则生成子系统重新学习,获得新的规则,不断地更新规则库,直到规则库稳定。 目前比较常用的分析指标有:险种、交费年期、被保人职业、被保人年收入、被保人年 龄段、被保人性别、被保人婚姻状况等。 实践中,可结合实际数据状况,对各要素进行适当的取舍,并做不同程度的概括,以形成 较为满意的判定树,产生可解释的结论成果。 图2数据挖掘系统架构

文档评论(0)

文档查询,农业合作 + 关注
官方认证
内容提供者

该用户很懒,什么也没介绍

认证主体土默特左旗农特农机经销部
IP属地广西
统一社会信用代码/组织机构代码
92150121MA0R6LAH4P

1亿VIP精品文档

相关文档