常用大数据词汇中英文对照表.docxVIP

  1. 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
  2. 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  3. 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  4. 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  5. 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  6. 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  7. 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
— PAGE \* Arabic 1 — 常用大数据词汇中英文对照表 常用大数据词汇中英文对照表 A 聚合(Aggregation)–搜索、合并、显示数据的过程 算法(Algorithms)–可以完成某种数据分析的数学公式 分析法(Analytics)–用于发现数据的内在涵义 异常检测(Anomaly detection)–在数据集中搜索与预期模式或行为不匹配的数据项。除了“Anomalies”,用来表示异常的词有以下几种:outliers,exceptions,surprises,contaminants.他们通常可提供关键的可执行信息 匿名化(Anonymization)–使数据匿名,即移除所有与个人隐私相关的数据 应用(Application)–实现某种特定功能的计算机软件 人工智能(Artificial Intelligence)–研发智能机器和智能软件,这些智能设备能够感知周遭的环境,并根据要求作出相应的反应,甚至能自我学习 B 行为分析法(Behavioural Analytics)–这种分析法是根据用户的行为如“怎么做”,“为什么这么做”,以及“做了什么”来得出结论,而不是仅仅针对人物和时间的一门分析学科,它着眼于数据中的人性化模 式 大数据科学家(Big Data Scientist)–能够设计大数据算法使得大数据变得有用的人 大数据创业公司(Big data startup)–指研发最新大数据技术的新兴公司 生物测定术(Biometrics)–根据个人的特征进行身份识别 B字节(BB:Brontobytes)–约等于1000YB(Yottabytes),相当于未来数字化宇宙的大小。1B字节包含了27个0! 商业智能(Business Intelligence)–是一系列理论、方法学和过程,使得数据更容易被理解 C 分类分析(Classification analysis)–从数据中获得重要的相关性信息的系统化过程;这类数据也被称为 元数据(meta data),是描述数据的数据 云计算(Cloud computing)–构建在网络上的分布式计算系统,数据是存储于机房外的(即云端) 聚类分析(Clustering analysis)–它是将相似的对象聚合在一起,每类相似的对象组合成一个聚类(也叫作簇)的过程。这种分析方法的目的在于分析数据间的差异和相似性 冷数据存储(Cold data storage)–在低功耗服务器上存储那些几乎不被使用的旧数据。但这些数据检索起来将会很耗时 对比分析(Comparative analysis)–在非常大的数据集中进行模式匹配时,进行一步步的对比和计算过程得到分析结果 复杂结构的数据(Complex structured data)–由两个或多个复杂而相互关联部分组成的数据,这类数据不能简单地由结构化查询语言或工具(SQL)解析 计算机产生的数据(Computer generated data)–如日志文件这类由计算机生成的数据 并发(Concurrency)–同时执行多个任务或运行多个进程 相关性分析(Correlation analysis)–是一种数据分析方法,用于分析变量之间是否存在正相关,或者负相关 客户关系管理(CRM:Customer Relationship Management)–用于管理销售、业务过程的一种技术,大 数据将影响公司的客户关系管理的策略 D 仪表板(Dashboard)–使用算法分析数据,并将结果用图表方式显示于仪表板中 数据聚合工具(Data aggregation tools)–将分散于众多数据源的数据转化成一个全新数据源的过程 数据分析师(Data analyst)–从事数据分析、建模、清理、处理的专业人员 数据库(Database)–一个以某种特定的技术来存储数据集合的仓库 数据库即服务(Database-as-a-Service)–部署在云端的数据库,即用即付,例如亚马逊云服务(AWS: Amazon Web Services) 数据库管理系统(DBMS:Database Management System)–收集、存储数据,并提供数据的访问 数据中心(Data centre)–一个实体地点,放置了用来存储数据的服务器 数据清洗(Data cle

文档评论(0)

182****8569 + 关注
官方认证
文档贡献者

该用户很懒,什么也没介绍

版权声明书
用户编号:6243214025000042
认证主体宁阳诺言网络科技服务中心(个体工商户)
IP属地山东
统一社会信用代码/组织机构代码
92370921MADC8M46XC

1亿VIP精品文档

相关文档