- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
.专业 .专注 .
最全的大数据术语合集
大数据的出现带来了许多新的术语
,但这些术语往往比较难以理解
。因此 ,一亦在国外的
一个网站上扒来了常用的大数据术语表
,抛砖引玉 ,供大家深入了解
。其中部分定义参考
了相应的博客文章
。当然 ,这份术语表并没有
100% 包含所有的术语
。一个常见的大数据
术语表
大数据的出现带来了许多新的术语
,但这些术语往往比较难以理解
。因此 ,我们通过本文
给出一个常用的大数据术语表
,抛砖引玉 ,供大家深入了解
。其中部分定义参考了相应的
博客文章 。 当然 ,这份术语表并没有
100% 包含所有的术语
,如果你认为有任何遗漏之
处,请告之我们 。
A
聚合 (Aggregation)
– 搜索 、合并、显示数据的过程
算法 (Algorithms)
– 可以完成某种数据分析的数学公式
分析法 (Analytics)
– 用于发现数据的内在涵义
异常检测 (Anomaly
detection)
– 在数据集中搜索与预期模式或行为不匹配的数据项
。除
了 “Anomalies
”, 用 来 表 示 异 常 的 词 有 以 下 几 种 : outliers,
exceptions,
surprises,
contaminants.
他们通常可提供关键的可执行信息
匿名化 (Anonymization) – 使数据匿名 ,即移除所有与个人隐私相关的数据
应用 (Application) – 实现某种特定功能的计算机软件
人工智能 (Artificial Intelligence) – 研发智能机器和智能软件 ,这些智能设备能够感知周遭
的环境 ,并根据要求作出相应的反应 ,甚至能自我学习
B
. word 可编辑 .
.专业 .专注 .
行为分析法 (Behavioural
Analytics) – 这种分析法是根据用户的行为如“怎么做 ”,“为什么
这么做 ”,以及 “做了什么 ”来得出结论 ,而不是仅仅针对人物和时间的一门分析学科
,它着
眼于数据中的人性化模式
大数据科学家 (Big Data Scientist)
– 能够设计大数据算法使得大数据变得有用的人
大数据创业公司 (Big data startup)
– 指研发最新大数据技术的新兴公司
生物测定术 (Biometrics)
– 根据个人的特征进行身份识别
B 字节 (BB: Brontobytes)
– 约等于 1000 YB(Yottabytes) ,相当于未来数字化宇宙的大小 。
1 B 字节包含了 27 个 0!
商业智能 (Business Intelligence)
–是一系列理论 、方法学和过程 ,使得数据更容易被理解
C
分类分析 (Classification analysis) – 从数据中获得重要的相关性信息的系统化过程 ; 这类数
据也被称为元数据 (meta data), 是描述数据的数据
云计算 (Cloud computing) – 构建在网络上的分布式计算系统 ,数据是存储于机房外的
(即云端 )
聚类分析 (Clustering analysis) – 它是将相似的对象聚合在一起 ,每类相似的对象组合成一
个聚类 (也叫作簇 )的过程 。 这种分析方法的目的在于分析数据间的差异和相似性
冷数据存储 (Cold data storage) – 在低功耗服务器上存储那些几乎不被使用的旧数据 。但
这些数据检索起来将会很耗时
对比分析 (Comparative analysis) – 在非常大的数据集中进行模式匹配时 ,进行一步步的对
比和计算过程得到分析结果
复杂结构的数据 (Complex structured data) –由两个或多个复杂而相互关联部分组成的数
. word 可编辑 .
.专业 .专注 .
据,这类数据不能简单地由结构化查询语言或工具 (SQL)解析
计算机产生的数据 (Computer generated data) – 如日志文件这类由计算机生成的数据
并发 (Concurrency) – 同时执行多个任务或运行多个进程
相关性分析 (Correlation analysis) – 是一种数据分析方法 ,用于分析变量之间是否存在正
相关 ,或者负相关
客户关系管理 (CRM: Customer Relationship Management) – 用于管理销售 、业务过程的
一种技术 ,大数据将影响公司的客户关系管理的策略
D
仪表板 (Dashboard) –使用算法分析数据 ,并将结果用图表方式显示于仪表板中
数据聚合工具 (Data aggregation tools) – 将分散于众多数据源的数据转化成一个全新数据
源的过程
数据
文档评论(0)