数据科学_鄂维南.docxVIP

  • 22
  • 0
  • 约1.14万字
  • 约 13页
  • 2019-01-02 发布于湖北
  • 举报
PAGE \* MERGEFORMAT1 数据科学——鄂维南 一、数据科学的基本内容 大数据时代在科学领域里的表现是数据科学的兴起。常常听到有人问:多大才算是“大数据”?“大数据”和“海量数据”有什么区别?其实根本没有必要为“大数据”这个名词的确切含义而纠结。“大数据”是一个热点名词,它代表的是一种潮流、一个时代,它可以有多方面的含义。“海量数据”是一个技术名词,它强调数据量之大。而数据科学则是一个学科、一门新兴的学科。 为什么要强调数据科学?它和已有的信息科学、统计学、机器学习等学科有什么不一样? 作为一门学科,数据科学所依赖的两个因素是数据的广泛性和多样性,以及数据研究的共性。现代社会的各行各业都充满了数据,而且这些数据也是多种多样,不仅包括传统的结构型数据,也包括象网页、文本、图像、视频、语音等非结构型数据。正如我们后面将要讨论到的,数据分析本质上都是在解反问题,而且是随机模型的反问题。所以,对它们的研究有着很多的共性。比方说自然语言处理和生物大分子模型里都用到隐式马氏过程和动态规划方法,其最根本的原因是它们处理的都是一维的随机信号。再如图像处理和统计学习中都用到的正则化方法,也是处理反问题的数学模型中最常用的一种手段。所以,用于图像处理的算法和用于压缩感知的算法有着许多共同之处。这在新加坡国立大学沈佐伟教授的工作中就可以很明显地看出来。 除了新兴的学科如计算广告学之外,

文档评论(0)

1亿VIP精品文档

相关文档