数据科学

厦门大学计算机系研究生课程《数据科学》课程主页

课程主讲教师:厦门大学计算机科学系助理教授  林子雨 博士

目标:打造计算机专业研究生精品课程

(声明:请勿将本网站内容用于商业用途,转载或引用请注明出处)

%e6%95%b0%e6%8d%ae%e7%a7%91%e5%ad%a6%e8%b0%83%e7%a0%94%e6%8a%a5%e5%91%8a%e4%b8%bb%e9%a1%b5%e4%ba%8c%e7%bb%b4%e7%a0%81

扫一扫访问本主页

数据学(Dataology)和数据科学(Data Science)(以下称数据学)是关于数据的科学或者研究数据的科学,定义为:研究探索Cyberspace中数据界(datanature)奥秘的理 论、方法和技术,研究的对象是数据界中的数据。与自然科学和社会科学不同,数据学和数据科学的研究对象是Cyber-space的数据,是新的科学。数据 学和数据科学主要有两个内涵:一个是研究数据本身,研究数据的各种类型、状态、属性及变化形式和变化规律;另一个是为自然科学和社会科学研究提供一种新的 方法,称为科学研究的数据方法,其目的在于揭示自然界和人类行为现象和规律[1]。

大数据技术原理与应用

(推荐:厦门大学林子雨编著《大数据技术原理与应用》教材

课程建设团队

《数据科学》课程建设小组成员(8人):林子雨(教师)、刘颖杰(2012级硕士研究生)、叶林宝(2012级硕士研究生)、蔡珉星(2013级硕士研究生)、李雨倩(女,2013级硕士研究生)、谢荣东(2014级硕士研究生)、罗道文(2014级硕士研究生)、李粲(女,2012级本科生)。

linziyu2014 刘颖杰  yelinbao 蔡珉星
林子雨 刘颖杰 叶林宝 蔡珉星
 李雨倩 谢荣东 罗道文  李粲
李雨倩 谢荣东 罗道文 李粲

调研分析

国内外相关高校开设《数据科学》课程、数据科学学位计划、数据科学短期培训班,进行数据科学家和数据工程师的培养。在中国,香港中文大学从2008 年起设立“数据科学商业统计”科学硕士学位;复旦大学从2007 年起开设数据科学讨论班,2010 年开始招收数据科学博士研究生,并从2013 年起开设研究生课程《数据科学》;北京航空航天大学于2012年设立大数据工程硕士学位。在美国,加州大学伯克利分校(UC Berkeley)从2011 年起开设《数据科学导论》课程,并从2012 年起开设《数据科学和分析》课程;伊利诺伊大学香槟分校(University of Illinois at Urbana-Champaign,UIUC)从2011 年起举办“数据科学暑期研究班”(Data Sciences Summer Instituteprogram);哥伦比亚大学(Columbia University)从2011 年起开设《数据科学导论》课程,2013 年起开设《应用数据科学》课程,并将从2013 年秋季起开设“数据科学专业成就认证”(Certification of Professional Achievement in Data Sciences)培训项目,并计划从2014 年起设立硕士学位,2015 年起设立博士学位;芝加哥大学(University of Chicago)开设3 个月的夏季培训课程;纽约大学(New YorkUniversity)将从2013 年秋季起设立“数据科学”硕士学位;南加州大学(South California University)设立“数据科学”硕士学位;华盛顿大学(University of Washington)从2013 年5 月起开设《数据科学导论》课程,并对修满数据科学相关课程学分的学生颁发数据科学证书(Certificate in Data Science);雪城大学(Syracuse University)也提供数据科学高级研究证书(Certificate Advanced Studies in Data Science)培训项目。在英国,邓迪大学从2013 年起设立“数据科学”科学硕士学位。从上述人才 的培养计划来看,数据科学家应该系统地掌握数据分析相关的技能,主要包括数学、统计学、数据分析、商业分析和自然语言处理等,具有较宽的知识面,具有独立 获取知识的能力,具有较强的实践能力和创新意识。其中,只有复旦大学的课程设置强调了数据科学家是研究数据的科学家,而不仅仅是一个数据工程师或者数据分 析师[2](查看中国大数据技术与产业发展白皮书2013原文)。

国内开设《数据科学》课程调研结果

大陆:根据网络调研结果,国内高校目前还没有关于已开设《数据科学》课程的相关资料,但是,不排除个别已经开设《数据科学》课程(因为有些教师可能没有为课程建立主页)。相关高校在数据科学领域开展了相关工作,比如,复旦大学设有“上海市数据科学重点实验室”和“数据科学研究中心”,清华大学数据科学研究院计划在2014年9月开始培养大数据硕士,华东师范大学设有“数据科学与工程研究院”。在教材方面,复旦大学朱扬勇、熊赟等人编写了《数据学》,北京理工大学杨旭、汤海京等人编写了《数据科学导论》。

香港:调研了中国香港几所主要大学,香港大学、香港中文大学、香港理工大学、香港科技大学、香港城市大学、香港浸会大学、香港岭南大学,都没有开设《数字科学》这门课,但是,有几所大学开设了《Data Analysis》这门课,但是并没有课程信息,只有简单介绍。(查看调研报告

台湾:中国台湾省各高校暂时未开设《数据科学》课程,通过公开的资料也未显示有开课准备。台湾民间有一个“资料科学实验室”组织,2014年召开了“台湾资料科学爱好者大会”,有开设资料科学相关课程。(查看调研报告

国外开设《数据科学》课程调研结果

美国:华盛顿大学开设了《Introduction to Data Science》,介绍了关系型数据库、MapReduce、NoSQL、基础数据分析、机器学习、可视化、图论。约翰霍普金斯大学在Coursera上一口气推出了9门Data Science方面的课程,组成“数据科学家”专项课程。(1)数据科学家的工具箱;(2)R语言程序开发;(3)获取和整理数据;(4)探索性数据分 析;(5)可重复性研究;(6)统计推断;(7)回归模型;(8)实用机器学习;(9)数据产品开发。纽约大学开设MS data science项目。哥伦比亚大学设有数据科学学院。MIT开设Introduction to Computational Thinking and Data Science(计算思维和数据科学导论)这门课,介绍如何利用计算机来理解真实世界的现象,目标受众是具备一定Python编程经验和计算复杂度基础知识的学生,课程强调必须更加照顾涉猎范围,而不是一味增加深度;为了这个目的,该课程会为学生提供许多主题的浅显介绍,这样学生就可以知道之后在他 们的职业生涯中可以用计算机去完成什么样的任务了;课程的主题包括,绘图、随机程序、概率和统计、随机漫步、蒙特卡洛模拟、数据模型化、优化问题和分类归 并。哈佛大学开设CS109 Data Science,有GitHubk课程资料。(更多内容请查看调研报告

英国:目前大概有七所高校开设了《数据科学》及其相关课程,包括谢菲尔德大学、爱丁堡大学、伦敦大学学院、东英吉利大学、布里斯托大学、曼彻斯特大学、 伦敦大学皇家霍洛威学院。其中,谢菲尔德大学和爱丁堡大学对于这一新兴专业归纳最全,并设立了相应的MSc;其他高校只设立了与数据科学相关的一些课程或专业,如曼大设立了数据与知识管理专业,东英吉利大学设立了知识发现与数据挖掘专业。(更多内容请查看调研报告

韩国、日本:经过对韩国科学技术院(KAIST)、浦项大学、首尔国立大学以及日本东京大学和京都大学的网络调研,可初步得出,韩国和日本目前还没有高校开设《数据科学》的课程。其中,韩国的三所大学有设立与数据科学相关的课程,但没有课件资料,也没有简要的课程介绍。(查看调研报告

调研报告汇总

调研内容 调研者 调研日期 调研报告
英国高校开设《数据科学》课程情况调研 李粲 2014年10月13日到15日 查看
国内大陆高校开设《数据科学》课程调研 谢荣东 2014年10月13日到16日 查看
美国高校开设《数据科学》课程情况调研 罗道文 2014年10月13日到16日 查看
日本、韩国高校开设《数据科学》课程情况调研 李粲 2014年10月17日到20日 查看
中国台湾高校开设《数据科学》课程情况调研 谢荣东 2014年10月17日到20日 查看
中国香港高校开设《数据科学》课程情况调研 罗道文 2014年10月17日到20日 查看

各个大学课程主页

美国

华盛顿大学 约翰霍普金斯大学 哥伦比亚大学  MIT  哈佛大学

英国

The University Of Sheffield The University Of Edinburgh University Science London
University Of East Angila University Of Bristol Royal Holloway

韩国

韩国科学技术院 韩国浦项大学 韩国首尔国立大学

学习课程

类别 课程
基础篇 概率论、线性代数、微分方程和微积分、建模、数据库
统计学
编程 Python,Java,JavaScript,R
机器学习
文本挖掘
数据可视化
大数据 Hadoop、NoSQL
工具集合

Hive, Tez/Stinger, Impala, Shark以及传统开源数据仓库brighthouse

Hawq/Greenplum, Phoenix, HadoopDB, Citusdata

 

相关书籍

中文 《数据学》朱扬勇, 熊赟. 复旦大学出版社. 2009年12月, 第1版 查看
中文 中国大数据技术与产业发展白皮书2013 查看
中文 《数据科学导论》杨旭,汤海京,丁刚毅主编,北京理工大学出版社,2014年3月出版 查看
英文 <An introduction to data science>, Jeffrey Stanton, Syracuse University, 2012 查看
英文 <Solving problems with visual analytics>, Eurographics Association, 2010
英文 <Advanced Reading List 2014-15, MSc Data Science>,The University of Sheffield提供的数据科学阅读书籍列表 查看
英文 Mining of Massive Datasets, 斯坦福大学,2010年 查看
英文 Foundations of Data Science,John Hopcroft, 2013年3月 查看

相关资料

中文 需求高涨的数据科学家 查看
中文 数据学将深刻影响人类未来 查看
中文 数据科学与数据挖掘 查看
英文 Data science and its relationship to big data and data-driven decision making 查看
英文 What is data science 查看
中文 从零开始,如何成长为一名数据科学家 查看
中文 怎样成为一个数据科学家? 查看
中文 中国计算机报独家策划:揭秘数据科学家 查看
中文 如何成为一名数据科学家? 查看
中文 加州大学伯克利分校数据科学专业设置 查看
中文 数据科学简介 查看
中文 数据科学家首先应该做的事情 查看
中文 数据科学与大数据的科学原理及发展前景 查看

课程建设大事记

*2014年10月13日,厦门大学数据库实验室林子雨老师团队正式启动厦门大学计算机科学系研究生课程《数据科学》的建设工作(查看动员书),整个建设过程历时1年左右,将于2015年9月正式对厦大计算机系研究生开放该课程。

*2014年10月14日,厦门大学《数据科学》课程主页正式上线,由林子雨老师负责内容维护,蔡珉星同学负责技术支持。

*2014年10月15日,李粲同学完成对英国高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月16日,谢荣东同学完成对国内大陆高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月16日,罗道文同学完成对美国高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月20日,李粲同学完成对日本、韩国高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月20日,谢荣东同学完成对中国台湾高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

* 2014年10月20日,罗道文同学完成对中国香港高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

参考文献

[1]朱扬勇, 数据学与数据科学. [TR][OL]. 2009. available at: http://www.dataology.fudan.edu.cn

[2]中国计算机学会大数据专家委员会. 中国大数据技术与产业发展白皮书2013.

怎样成为一个数据科学家?