厦门大学计算机系研究生课程《数据科学》课程主页

2023-10-28 08:08

本文主要是介绍厦门大学计算机系研究生课程《数据科学》课程主页,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

http://dblab.edu.cn/post/2984/



调研分析

国内外相关高校开设《数据科学》课程、数据科学学位计划、数据科学短期培训班,进行数据科学家和数据工程师的培养。在中国,香港中文大学从2008 年起设立“数据科学商业统计”科学硕士学位;复旦大学从2007 年起开设数据科学讨论班,2010 年开始招收数据科学博士研究生,并从2013 年起开设研究生课程《数据科学》;北京航空航天大学于2012年设立大数据工程硕士学位。在美国,加州大学伯克利分校(UC Berkeley)从2011 年起开设《数据科学导论》课程,并从2012 年起开设《数据科学和分析》课程;伊利诺伊大学香槟分校(University of Illinois at Urbana-Champaign,UIUC)从2011 年起举办“数据科学暑期研究班”(Data Sciences Summer Instituteprogram);哥伦比亚大学(Columbia University)从2011 年起开设《数据科学导论》课程,2013 年起开设《应用数据科学》课程,并将从2013 年秋季起开设“数据科学专业成就认证”(Certification of Professional Achievement in Data Sciences)培训项目,并计划从2014 年起设立硕士学位,2015 年起设立博士学位;芝加哥大学(University of Chicago)开设3 个月的夏季培训课程;纽约大学(New YorkUniversity)将从2013 年秋季起设立“数据科学”硕士学位;南加州大学(South California University)设立“数据科学”硕士学位;华盛顿大学(University of Washington)从2013 年5 月起开设《数据科学导论》课程,并对修满数据科学相关课程学分的学生颁发数据科学证书(Certificate in Data Science);雪城大学(Syracuse University)也提供数据科学高级研究证书(Certificate Advanced Studies in Data Science)培训项目。在英国,邓迪大学从2013 年起设立“数据科学”科学硕士学位。从上述人才 的培养计划来看,数据科学家应该系统地掌握数据分析相关的技能,主要包括数学、统计学、数据分析、商业分析和自然语言处理等,具有较宽的知识面,具有独立 获取知识的能力,具有较强的实践能力和创新意识。其中,只有复旦大学的课程设置强调了数据科学家是研究数据的科学家,而不仅仅是一个数据工程师或者数据分 析师[2](查看中国大数据技术与产业发展白皮书2013原文)。

国内开设《数据科学》课程调研结果

大陆:根据网络调研结果,国内高校目前还没有关于已开设《数据科学》课程的相关资料,但是,不排除个别已经开设《数据科学》课程(因为有些教师可能没有为课程建立主页)。相关高校在数据科学领域开展了相关工作,比如,复旦大学设有“上海市数据科学重点实验室”和“数据科学研究中心”,清华大学数据科学研究院计划在2014年9月开始培养大数据硕士,华东师范大学设有“数据科学与工程研究院”。在教材方面,复旦大学朱扬勇、熊赟等人编写了《数据学》,北京理工大学杨旭、汤海京等人编写了《数据科学导论》。

香港:调研了中国香港几所主要大学,香港大学、香港中文大学、香港理工大学、香港科技大学、香港城市大学、香港浸会大学、香港岭南大学,都没有开设《数字科学》这门课,但是,有几所大学开设了《Data Analysis》这门课,但是并没有课程信息,只有简单介绍。(查看调研报告)

台湾:中国台湾省各高校暂时未开设《数据科学》课程,通过公开的资料也未显示有开课准备。台湾民间有一个“资料科学实验室”组织,2014年召开了“台湾资料科学爱好者大会”,有开设资料科学相关课程。(查看调研报告)

国外开设《数据科学》课程调研结果

美国:华盛顿大学开设了《Introduction to Data Science》,介绍了关系型数据库、MapReduce、NoSQL、基础数据分析、机器学习、可视化、图论。约翰霍普金斯大学在Coursera上一口气推出了9门Data Science方面的课程,组成“数据科学家”专项课程。(1)数据科学家的工具箱;(2)R语言程序开发;(3)获取和整理数据;(4)探索性数据分 析;(5)可重复性研究;(6)统计推断;(7)回归模型;(8)实用机器学习;(9)数据产品开发。纽约大学开设MS data science项目。哥伦比亚大学设有数据科学学院。MIT开设Introduction to Computational Thinking and Data Science(计算思维和数据科学导论)这门课,介绍如何利用计算机来理解真实世界的现象,目标受众是具备一定Python编程经验和计算复杂度基础知识的学生,课程强调必须更加照顾涉猎范围,而不是一味增加深度;为了这个目的,该课程会为学生提供许多主题的浅显介绍,这样学生就可以知道之后在他 们的职业生涯中可以用计算机去完成什么样的任务了;课程的主题包括,绘图、随机程序、概率和统计、随机漫步、蒙特卡洛模拟、数据模型化、优化问题和分类归 并。哈佛大学开设CS109 Data Science,有GitHubk课程资料。(更多内容请查看调研报告)

英国:目前大概有七所高校开设了《数据科学》及其相关课程,包括谢菲尔德大学、爱丁堡大学、伦敦大学学院、东英吉利大学、布里斯托大学、曼彻斯特大学、 伦敦大学皇家霍洛威学院。其中,谢菲尔德大学和爱丁堡大学对于这一新兴专业归纳最全,并设立了相应的MSc;其他高校只设立了与数据科学相关的一些课程或专业,如曼大设立了数据与知识管理专业,东英吉利大学设立了知识发现与数据挖掘专业。(更多内容请查看调研报告)

韩国、日本:经过对韩国科学技术院(KAIST)、浦项大学、首尔国立大学以及日本东京大学和京都大学的网络调研,可初步得出,韩国和日本目前还没有高校开设《数据科学》的课程。其中,韩国的三所大学有设立与数据科学相关的课程,但没有课件资料,也没有简要的课程介绍。(查看调研报告)

调研报告汇总

调研内容 调研者 调研日期 调研报告
英国高校开设《数据科学》课程情况调研 李粲 2014年10月13日到15日 查看
国内大陆高校开设《数据科学》课程调研 谢荣东 2014年10月13日到16日 查看
美国高校开设《数据科学》课程情况调研 罗道文 2014年10月13日到16日 查看
日本、韩国高校开设《数据科学》课程情况调研 李粲 2014年10月17日到20日 查看
中国台湾高校开设《数据科学》课程情况调研 谢荣东 2014年10月17日到20日 查看
中国香港高校开设《数据科学》课程情况调研 罗道文 2014年10月17日到20日 查看

各个大学课程主页

美国

华盛顿大学 约翰霍普金斯大学 哥伦比亚大学  MIT  哈佛大学

英国

The University Of Sheffield The University Of Edinburgh University Science London
University Of East Angila University Of Bristol Royal Holloway

韩国

韩国科学技术院 韩国浦项大学 韩国首尔国立大学

学习课程

类别 课程
基础篇 概率论、线性代数、微分方程和微积分、建模、数据库
统计学  
编程 Python,Java,JavaScript,R
机器学习  
文本挖掘  
数据可视化  
大数据 Hadoop、NoSQL
工具集合

Hive, Tez/Stinger, Impala, Shark以及传统开源数据仓库brighthouse

Hawq/Greenplum, Phoenix, HadoopDB, Citusdata

 

相关书籍

中文 《数据学》朱扬勇, 熊赟. 复旦大学出版社. 2009年12月, 第1版 查看
中文 中国大数据技术与产业发展白皮书2013 查看
中文 《数据科学导论》杨旭,汤海京,丁刚毅主编,北京理工大学出版社,2014年3月出版 查看
英文 <An introduction to data science>, Jeffrey Stanton, Syracuse University, 2012 查看
英文 <Solving problems with visual analytics>, Eurographics Association, 2010  
英文 <Advanced Reading List 2014-15, MSc Data Science>,The University of Sheffield提供的数据科学阅读书籍列表 查看
英文 Mining of Massive Datasets, 斯坦福大学,2010年 查看
英文 Foundations of Data Science,John Hopcroft, 2013年3月 查看

相关资料

中文 需求高涨的数据科学家 查看
中文 数据学将深刻影响人类未来 查看
中文 数据科学与数据挖掘 查看
英文 Data science and its relationship to big data and data-driven decision making 查看
英文 What is data science 查看
中文 从零开始,如何成长为一名数据科学家 查看
中文 怎样成为一个数据科学家? 查看
中文 中国计算机报独家策划:揭秘数据科学家 查看
中文 如何成为一名数据科学家? 查看

课程建设大事记

*2014年10月13日,厦门大学数据库实验室林子雨老师团队正式启动厦门大学计算机科学系研究生课程《数据科学》的建设工作(查看动员书),整个建设过程历时1年左右,将于2015年9月正式对厦大计算机系研究生开放该课程。

*2014年10月14日,厦门大学《数据科学》课程主页正式上线,由林子雨老师负责内容维护,蔡珉星同学负责技术支持。

*2014年10月15日,李粲同学完成对英国高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月16日,谢荣东同学完成对国内大陆高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月16日,罗道文同学完成对美国高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月20日,李粲同学完成对日本、韩国高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月20日,谢荣东同学完成对中国台湾高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

* 2014年10月20日,罗道文同学完成对中国香港高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

参考文献

[1]朱扬勇, 数据学与数据科学. [TR][OL]. 2009. available at: http://www.dataology.fudan.edu.cn

[2]中国计算机学会大数据专家委员会. 中国大数据技术与产业发展白皮书2013.

怎样成为一个数据科学家?


这篇关于厦门大学计算机系研究生课程《数据科学》课程主页的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/291850

相关文章

SQL Server修改数据库名及物理数据文件名操作步骤

《SQLServer修改数据库名及物理数据文件名操作步骤》在SQLServer中重命名数据库是一个常见的操作,但需要确保用户具有足够的权限来执行此操作,:本文主要介绍SQLServer修改数据... 目录一、背景介绍二、操作步骤2.1 设置为单用户模式(断开连接)2.2 修改数据库名称2.3 查找逻辑文件名

canal实现mysql数据同步的详细过程

《canal实现mysql数据同步的详细过程》:本文主要介绍canal实现mysql数据同步的详细过程,本文通过实例图文相结合给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的... 目录1、canal下载2、mysql同步用户创建和授权3、canal admin安装和启动4、canal

使用SpringBoot整合Sharding Sphere实现数据脱敏的示例

《使用SpringBoot整合ShardingSphere实现数据脱敏的示例》ApacheShardingSphere数据脱敏模块,通过SQL拦截与改写实现敏感信息加密存储,解决手动处理繁琐及系统改... 目录痛点一:痛点二:脱敏配置Quick Start——Spring 显示配置:1.引入依赖2.创建脱敏

详解如何使用Python构建从数据到文档的自动化工作流

《详解如何使用Python构建从数据到文档的自动化工作流》这篇文章将通过真实工作场景拆解,为大家展示如何用Python构建自动化工作流,让工具代替人力完成这些数字苦力活,感兴趣的小伙伴可以跟随小编一起... 目录一、Excel处理:从数据搬运工到智能分析师二、PDF处理:文档工厂的智能生产线三、邮件自动化:

Python数据分析与可视化的全面指南(从数据清洗到图表呈现)

《Python数据分析与可视化的全面指南(从数据清洗到图表呈现)》Python是数据分析与可视化领域中最受欢迎的编程语言之一,凭借其丰富的库和工具,Python能够帮助我们快速处理、分析数据并生成高质... 目录一、数据采集与初步探索二、数据清洗的七种武器1. 缺失值处理策略2. 异常值检测与修正3. 数据

pandas实现数据concat拼接的示例代码

《pandas实现数据concat拼接的示例代码》pandas.concat用于合并DataFrame或Series,本文主要介绍了pandas实现数据concat拼接的示例代码,具有一定的参考价值,... 目录语法示例:使用pandas.concat合并数据默认的concat:参数axis=0,join=

C#代码实现解析WTGPS和BD数据

《C#代码实现解析WTGPS和BD数据》在现代的导航与定位应用中,准确解析GPS和北斗(BD)等卫星定位数据至关重要,本文将使用C#语言实现解析WTGPS和BD数据,需要的可以了解下... 目录一、代码结构概览1. 核心解析方法2. 位置信息解析3. 经纬度转换方法4. 日期和时间戳解析5. 辅助方法二、L

使用Python和Matplotlib实现可视化字体轮廓(从路径数据到矢量图形)

《使用Python和Matplotlib实现可视化字体轮廓(从路径数据到矢量图形)》字体设计和矢量图形处理是编程中一个有趣且实用的领域,通过Python的matplotlib库,我们可以轻松将字体轮廓... 目录背景知识字体轮廓的表示实现步骤1. 安装依赖库2. 准备数据3. 解析路径指令4. 绘制图形关键

解决mysql插入数据锁等待超时报错:Lock wait timeout exceeded;try restarting transaction

《解决mysql插入数据锁等待超时报错:Lockwaittimeoutexceeded;tryrestartingtransaction》:本文主要介绍解决mysql插入数据锁等待超时报... 目录报错信息解决办法1、数据库中执行如下sql2、再到 INNODB_TRX 事务表中查看总结报错信息Lock

使用C#删除Excel表格中的重复行数据的代码详解

《使用C#删除Excel表格中的重复行数据的代码详解》重复行是指在Excel表格中完全相同的多行数据,删除这些重复行至关重要,因为它们不仅会干扰数据分析,还可能导致错误的决策和结论,所以本文给大家介绍... 目录简介使用工具C# 删除Excel工作表中的重复行语法工作原理实现代码C# 删除指定Excel单元