星光数据文本大数据价值挖掘.docVIP

  • 12
  • 0
  • 约3.37千字
  • 约 8页
  • 2018-09-11 发布于福建
  • 举报
星光数据文本大数据价值挖掘

星光数据文本大数据价值挖掘   我们如今生活在一个“大数据时代”,政府、企业、个人每天都在制造海量数据,文本大数据应运而生,越来越多的文本技术公司开始投身到这片蓝海之中,挖掘藏在数据中的价值。北京智慧星光信息技术有限公司董事长李青龙认为,在大数据分析中,这类数据虽然至关重要,但如何大规模对这些数据进行最有效地分析还较为模糊,目前我国绝大多数的数据分析公司尚不具备对其分析的能力。   第一时间挖掘全量数据是根本   当下“数据”的概念也发生了巨大变化。过去似乎只有电子表单上那些数值型信息,才可以被称为“数据”,但现在的“数据”可以是网络上任何的非结构化信息。   对此,李青龙进行了详细介绍:“数据分为两类:一类是结构化数据,是可计算、可统计、可分析的数据,统计学、运筹学等学科都是在解决结构化数据的问题。经过多年的发展,业界已经做了大量的积累,对于数据的获取、存储、处理、检索等,已经具备了相当多的技术储备,难以再有大的突破;另一类是非结构化数据,即以文本为核心的文本、图片、视频等,表现的特征是碎片式,不可统计、不可计算、不可分析,这些特点赋予了文本数据巨大的价值。可以理解为,对文本等非结构化数据的分析比数值型这类结构化数据的分析更为重要。”   对于非结构化的大数据,特别是文本大数据,业界正在持续加大投入。   同时,随着硬件设备的提升,使得硬件设备处理非结构化数据量远远

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档