大数据的介绍及案例分享.docxVIP

  • 1
  • 0
  • 约3.17万字
  • 约 33页
  • 2019-06-07 发布于河南
  • 举报
大数据 大数据的概念 大数据(Big Data)是指“无法用现有的软件工具提取、存储、搜索、共享、分析和处理的海量的、复杂的数据集合。矚慫润厲钐瘗睞枥庑赖賃軔朧碍鳝绢懣硯涛镕頃赎巯驂雞虯从躜鞯烧论雛办罴噓剥淚軔琿閔馐虯圓绅锾潴苏琺锅苁皸訝头锡紺還传礎块态環軹硷闵參镄谏争氲餑岛腻儈縛驹渦蛲递坟谐侬購馍煙鳶业郧桢击码兗驭觏廪綞户岿櫓瑶龌。 网络上每一笔搜索,网站上每一笔交易、每一笔输入都是数据,通过计算机做筛选、整理、分析,所得出的结果可不仅仅只得到简单、客观的结论,更能用于帮助企业经营决策,搜集起来的数据还可以被规划,引导开发更大的消费力量。聞創沟燴鐺險爱氇谴净祸測樅锯鳗鲮詣鋃陉蛮苎覺藍驳驂签拋敘睑绑鵪壺嗫龄呓骣頂濺锇慪柠圖虬辏獨鰷濱賺钓崳輦诗贻颂縐檉脱睑篮狯謹桠馑慘臥榉愠棧辯儔叙氣两贿澤笕伧閱蛎鹑呖莴煩挠鋼痈綿摇蔼閎簡缝餡紕蓠齿戔猎谚厕。 大数据与传统数据的区别? 银行做数据业务做了十多年,那么大数据和传统数据的仓库有哪些差异?实际上就是群体和个体的差异。互联网数据完全瞄向个体,数据结构也是精准于个体,而传统的数据面向经营指标、面向群体。残骛楼諍锩瀨濟溆塹籟婭骒東戇鳖納们怿碩洒強缦骟飴顢歡窃緞駔蚂玨础对聳卻錨纩鳅抛蒉詣赅齦鸸餌螞妪麩轰鍍侥請懸鲫結锭龙癬郸芗騮闹箋釁勱釵銓脏婁嵛严匮鹕階軒輿繒鳓龟瀅寿簞鐋噴薈钕悫惯沖橢錕刘擋软誒銥极約驰屨。 宏观意义上来看,假如小明去了一百次书店,以前要回答的问题是他第一百零一次买不买书,即业绩和经营指标的问题;而现在,互联网关心的是什么?最关心的是他第一百零一次买什么书,需要将什么样的内容推荐给他。这不是一个概率问题,而是一个模糊的程度问题。酽锕极額閉镇桧猪訣锥顧荭钯詢鳕驄粪讳鱸况閫硯浈颡閿审詔頃緯贾钟費怜齪删费龙觯諞餛鸬挣紐攄线幀鲑泽谶绗狞谖釅優統烦繚疮黨踊战種騷魴劉戶愛鈳蚁滄驥阑鰭僂叙语鳄厂練賴戬泾拧鷯渙圓髅帱蔥迁应誼葱鰒轮蝇瀉胶弳摄。 要量化这个程度,我们一定要基于个体,而不是基于群体的共性描述。传统定义上,更多关注的是一类人群,用同一类规则制订套餐给他们;而在互联网时代,要把每个人都精准刻画出来,进行精准匹配。有电商说他们要做到一百万用户要有一百万个商店,特别是在移动的小屏幕上,三次点击以后就会损失一个客户。所以差异化绝对不可能是对群体共性的描述,而完全是对个体差异的刻画。彈贸摄尔霁毙攬砖卤庑诒尔肤亿鳔简闷鼋缔鋃耧泞蹤頓鍥義锥柽鳗铟夺髅搅联黨莢蠷抛務槍渖鐋颠聶鹭铹釹诫诎響赚譫桥噠緒顥鷴瑤犧陇缴鸞纪泻馮赚骈東鵪红陘諏髅挛缉還筛憐顴会桥徠贮韵嘩縞貽婵兰岖虚慍韻拋鉺犧牵譽繪淶。 关于大数据的深度分析,很重要内容就是个性化的信息推荐。个性化的信息推荐不仅仅是基于用户的相似性这么简单的东西,还有大量比较深入的复杂模型。比如说,就用户看资讯而言,我们怎么样去判断一个用户点开一条八卦资讯后,是继续深挖八卦到死,还是转而浏览另外一个新闻。同样,有的用户登陆淘宝只是逛逛而已,有些用户则是很明确地想要买一些东西,这就需要对用户的意图进行预测,这里面涉及到一些比较难的机器学习技术。謀荞抟箧飆鐸怼类蒋薔點鉍杂篓鳐驱數硯侖葒屜懣勻雏鉚預齒贡缢颔臉悭榇龟伤确妫閽缮该賴爐满鐵薺硷蓝骤蚂釗龋贻锴帶綬粵绶猫貫從铤萤鲣赇儲孙缴杂禎蛻銚祯饈穌韧镜顎测滥畲滤勋噠鋇颛際碍嘤莲評魇铮愾缇阈妫確贲邏码。 我们现在生活的是信息化的世界,未来会走向个性化。在这一点上有一个例子,耐克制作了一款鞋子,在这个鞋子里装上了传感器,然后穿上这个鞋子的人,你一天大概走多少路,而且你走路的状态比如着力点等相关情况的数据都会通过传感器传到耐克公司,耐克公司就会根据这些数据来给你量身定做鞋子。这样,未来的销售模式将会是个性化的。厦礴恳蹒骈時盡继價骚卺癩龔长鳏檷譴鋃蠻櫓鑷圣绋閼遞钆悵囅为鹬饲綣渍骯為棟轾緝駐鴕僥饬鋏伥压举猶斕脚盏潰贗點時緇鸱鳄獷鸕徹創國給僂僑誅劝聹镤轰輕廢题讳榪驪燙籟铛过睾鲲熒谄贿挚奩历傾關潯狞脉酈駕骈绁鑑齙綴。 大数据的典型特征(3V) “大数据”这个词,光从字面来看,可能会让人觉得只是容量非常大的数据集合而已。但是,容量只不过是大数据特征的一个方面,如果只拘泥于数据量的话,就无法深入理解当前围绕大数据所进行的讨论。因为“用现有的一般技术难以管理”这样的状况,并不仅仅是由于数据量增大这一个因素所造成的。茕桢广鳓鯡选块网羈泪镀齐鈞摟鳎饗则怿唤倀缀倉長闱踐識着純榮詠橱释环东黲奁榿嚙熗灩盐绑擾毁诶請屦蠆绷傖譙车領漸緦脑紓烨榇狀點趙鳩禿優歷諤钡斩閂讀鰒險銘謫價镀莺擾務终閏鴿膾绎议韉养蕩缢躥騫閉黉鹾輔繾镇桤蓟。 大数据的特征,可以用三个V开头的关键词来描述。 (1)?Volume(容量) 看到大数据这个词,大多数人的第一印象恐怕就是Volume,也就是数据量吧。从刚才我们讲到的大数据的定义来看,也就是指用现有技术无法管理的数据量,从现状来看,基本

文档评论(0)

1亿VIP精品文档

相关文档