厦门大学计算机系研究生课程《数据科学》课程主页

2023-10-28 08:08

本文主要是介绍厦门大学计算机系研究生课程《数据科学》课程主页,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

http://dblab.edu.cn/post/2984/



调研分析

国内外相关高校开设《数据科学》课程、数据科学学位计划、数据科学短期培训班,进行数据科学家和数据工程师的培养。在中国,香港中文大学从2008 年起设立“数据科学商业统计”科学硕士学位;复旦大学从2007 年起开设数据科学讨论班,2010 年开始招收数据科学博士研究生,并从2013 年起开设研究生课程《数据科学》;北京航空航天大学于2012年设立大数据工程硕士学位。在美国,加州大学伯克利分校(UC Berkeley)从2011 年起开设《数据科学导论》课程,并从2012 年起开设《数据科学和分析》课程;伊利诺伊大学香槟分校(University of Illinois at Urbana-Champaign,UIUC)从2011 年起举办“数据科学暑期研究班”(Data Sciences Summer Instituteprogram);哥伦比亚大学(Columbia University)从2011 年起开设《数据科学导论》课程,2013 年起开设《应用数据科学》课程,并将从2013 年秋季起开设“数据科学专业成就认证”(Certification of Professional Achievement in Data Sciences)培训项目,并计划从2014 年起设立硕士学位,2015 年起设立博士学位;芝加哥大学(University of Chicago)开设3 个月的夏季培训课程;纽约大学(New YorkUniversity)将从2013 年秋季起设立“数据科学”硕士学位;南加州大学(South California University)设立“数据科学”硕士学位;华盛顿大学(University of Washington)从2013 年5 月起开设《数据科学导论》课程,并对修满数据科学相关课程学分的学生颁发数据科学证书(Certificate in Data Science);雪城大学(Syracuse University)也提供数据科学高级研究证书(Certificate Advanced Studies in Data Science)培训项目。在英国,邓迪大学从2013 年起设立“数据科学”科学硕士学位。从上述人才 的培养计划来看,数据科学家应该系统地掌握数据分析相关的技能,主要包括数学、统计学、数据分析、商业分析和自然语言处理等,具有较宽的知识面,具有独立 获取知识的能力,具有较强的实践能力和创新意识。其中,只有复旦大学的课程设置强调了数据科学家是研究数据的科学家,而不仅仅是一个数据工程师或者数据分 析师[2](查看中国大数据技术与产业发展白皮书2013原文)。

国内开设《数据科学》课程调研结果

大陆:根据网络调研结果,国内高校目前还没有关于已开设《数据科学》课程的相关资料,但是,不排除个别已经开设《数据科学》课程(因为有些教师可能没有为课程建立主页)。相关高校在数据科学领域开展了相关工作,比如,复旦大学设有“上海市数据科学重点实验室”和“数据科学研究中心”,清华大学数据科学研究院计划在2014年9月开始培养大数据硕士,华东师范大学设有“数据科学与工程研究院”。在教材方面,复旦大学朱扬勇、熊赟等人编写了《数据学》,北京理工大学杨旭、汤海京等人编写了《数据科学导论》。

香港:调研了中国香港几所主要大学,香港大学、香港中文大学、香港理工大学、香港科技大学、香港城市大学、香港浸会大学、香港岭南大学,都没有开设《数字科学》这门课,但是,有几所大学开设了《Data Analysis》这门课,但是并没有课程信息,只有简单介绍。(查看调研报告)

台湾:中国台湾省各高校暂时未开设《数据科学》课程,通过公开的资料也未显示有开课准备。台湾民间有一个“资料科学实验室”组织,2014年召开了“台湾资料科学爱好者大会”,有开设资料科学相关课程。(查看调研报告)

国外开设《数据科学》课程调研结果

美国:华盛顿大学开设了《Introduction to Data Science》,介绍了关系型数据库、MapReduce、NoSQL、基础数据分析、机器学习、可视化、图论。约翰霍普金斯大学在Coursera上一口气推出了9门Data Science方面的课程,组成“数据科学家”专项课程。(1)数据科学家的工具箱;(2)R语言程序开发;(3)获取和整理数据;(4)探索性数据分 析;(5)可重复性研究;(6)统计推断;(7)回归模型;(8)实用机器学习;(9)数据产品开发。纽约大学开设MS data science项目。哥伦比亚大学设有数据科学学院。MIT开设Introduction to Computational Thinking and Data Science(计算思维和数据科学导论)这门课,介绍如何利用计算机来理解真实世界的现象,目标受众是具备一定Python编程经验和计算复杂度基础知识的学生,课程强调必须更加照顾涉猎范围,而不是一味增加深度;为了这个目的,该课程会为学生提供许多主题的浅显介绍,这样学生就可以知道之后在他 们的职业生涯中可以用计算机去完成什么样的任务了;课程的主题包括,绘图、随机程序、概率和统计、随机漫步、蒙特卡洛模拟、数据模型化、优化问题和分类归 并。哈佛大学开设CS109 Data Science,有GitHubk课程资料。(更多内容请查看调研报告)

英国:目前大概有七所高校开设了《数据科学》及其相关课程,包括谢菲尔德大学、爱丁堡大学、伦敦大学学院、东英吉利大学、布里斯托大学、曼彻斯特大学、 伦敦大学皇家霍洛威学院。其中,谢菲尔德大学和爱丁堡大学对于这一新兴专业归纳最全,并设立了相应的MSc;其他高校只设立了与数据科学相关的一些课程或专业,如曼大设立了数据与知识管理专业,东英吉利大学设立了知识发现与数据挖掘专业。(更多内容请查看调研报告)

韩国、日本:经过对韩国科学技术院(KAIST)、浦项大学、首尔国立大学以及日本东京大学和京都大学的网络调研,可初步得出,韩国和日本目前还没有高校开设《数据科学》的课程。其中,韩国的三所大学有设立与数据科学相关的课程,但没有课件资料,也没有简要的课程介绍。(查看调研报告)

调研报告汇总

调研内容 调研者 调研日期 调研报告
英国高校开设《数据科学》课程情况调研 李粲 2014年10月13日到15日 查看
国内大陆高校开设《数据科学》课程调研 谢荣东 2014年10月13日到16日 查看
美国高校开设《数据科学》课程情况调研 罗道文 2014年10月13日到16日 查看
日本、韩国高校开设《数据科学》课程情况调研 李粲 2014年10月17日到20日 查看
中国台湾高校开设《数据科学》课程情况调研 谢荣东 2014年10月17日到20日 查看
中国香港高校开设《数据科学》课程情况调研 罗道文 2014年10月17日到20日 查看

各个大学课程主页

美国

华盛顿大学 约翰霍普金斯大学 哥伦比亚大学  MIT  哈佛大学

英国

The University Of Sheffield The University Of Edinburgh University Science London
University Of East Angila University Of Bristol Royal Holloway

韩国

韩国科学技术院 韩国浦项大学 韩国首尔国立大学

学习课程

类别 课程
基础篇 概率论、线性代数、微分方程和微积分、建模、数据库
统计学  
编程 Python,Java,JavaScript,R
机器学习  
文本挖掘  
数据可视化  
大数据 Hadoop、NoSQL
工具集合

Hive, Tez/Stinger, Impala, Shark以及传统开源数据仓库brighthouse

Hawq/Greenplum, Phoenix, HadoopDB, Citusdata

 

相关书籍

中文 《数据学》朱扬勇, 熊赟. 复旦大学出版社. 2009年12月, 第1版 查看
中文 中国大数据技术与产业发展白皮书2013 查看
中文 《数据科学导论》杨旭,汤海京,丁刚毅主编,北京理工大学出版社,2014年3月出版 查看
英文 <An introduction to data science>, Jeffrey Stanton, Syracuse University, 2012 查看
英文 <Solving problems with visual analytics>, Eurographics Association, 2010  
英文 <Advanced Reading List 2014-15, MSc Data Science>,The University of Sheffield提供的数据科学阅读书籍列表 查看
英文 Mining of Massive Datasets, 斯坦福大学,2010年 查看
英文 Foundations of Data Science,John Hopcroft, 2013年3月 查看

相关资料

中文 需求高涨的数据科学家 查看
中文 数据学将深刻影响人类未来 查看
中文 数据科学与数据挖掘 查看
英文 Data science and its relationship to big data and data-driven decision making 查看
英文 What is data science 查看
中文 从零开始,如何成长为一名数据科学家 查看
中文 怎样成为一个数据科学家? 查看
中文 中国计算机报独家策划:揭秘数据科学家 查看
中文 如何成为一名数据科学家? 查看

课程建设大事记

*2014年10月13日,厦门大学数据库实验室林子雨老师团队正式启动厦门大学计算机科学系研究生课程《数据科学》的建设工作(查看动员书),整个建设过程历时1年左右,将于2015年9月正式对厦大计算机系研究生开放该课程。

*2014年10月14日,厦门大学《数据科学》课程主页正式上线,由林子雨老师负责内容维护,蔡珉星同学负责技术支持。

*2014年10月15日,李粲同学完成对英国高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月16日,谢荣东同学完成对国内大陆高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月16日,罗道文同学完成对美国高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月20日,李粲同学完成对日本、韩国高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

*2014年10月20日,谢荣东同学完成对中国台湾高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

* 2014年10月20日,罗道文同学完成对中国香港高校开设《数据科学》课程相关情况的调研,并提交调研报告(查看调研报告)。

参考文献

[1]朱扬勇, 数据学与数据科学. [TR][OL]. 2009. available at: http://www.dataology.fudan.edu.cn

[2]中国计算机学会大数据专家委员会. 中国大数据技术与产业发展白皮书2013.

怎样成为一个数据科学家?


这篇关于厦门大学计算机系研究生课程《数据科学》课程主页的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/291850

相关文章

大模型研发全揭秘:客服工单数据标注的完整攻略

在人工智能(AI)领域,数据标注是模型训练过程中至关重要的一步。无论你是新手还是有经验的从业者,掌握数据标注的技术细节和常见问题的解决方案都能为你的AI项目增添不少价值。在电信运营商的客服系统中,工单数据是客户问题和解决方案的重要记录。通过对这些工单数据进行有效标注,不仅能够帮助提升客服自动化系统的智能化水平,还能优化客户服务流程,提高客户满意度。本文将详细介绍如何在电信运营商客服工单的背景下进行

基于MySQL Binlog的Elasticsearch数据同步实践

一、为什么要做 随着马蜂窝的逐渐发展,我们的业务数据越来越多,单纯使用 MySQL 已经不能满足我们的数据查询需求,例如对于商品、订单等数据的多维度检索。 使用 Elasticsearch 存储业务数据可以很好的解决我们业务中的搜索需求。而数据进行异构存储后,随之而来的就是数据同步的问题。 二、现有方法及问题 对于数据同步,我们目前的解决方案是建立数据中间表。把需要检索的业务数据,统一放到一张M

关于数据埋点,你需要了解这些基本知识

产品汪每天都在和数据打交道,你知道数据来自哪里吗? 移动app端内的用户行为数据大多来自埋点,了解一些埋点知识,能和数据分析师、技术侃大山,参与到前期的数据采集,更重要是让最终的埋点数据能为我所用,否则可怜巴巴等上几个月是常有的事。   埋点类型 根据埋点方式,可以区分为: 手动埋点半自动埋点全自动埋点 秉承“任何事物都有两面性”的道理:自动程度高的,能解决通用统计,便于统一化管理,但个性化定

使用SecondaryNameNode恢复NameNode的数据

1)需求: NameNode进程挂了并且存储的数据也丢失了,如何恢复NameNode 此种方式恢复的数据可能存在小部分数据的丢失。 2)故障模拟 (1)kill -9 NameNode进程 [lytfly@hadoop102 current]$ kill -9 19886 (2)删除NameNode存储的数据(/opt/module/hadoop-3.1.4/data/tmp/dfs/na

异构存储(冷热数据分离)

异构存储主要解决不同的数据,存储在不同类型的硬盘中,达到最佳性能的问题。 异构存储Shell操作 (1)查看当前有哪些存储策略可以用 [lytfly@hadoop102 hadoop-3.1.4]$ hdfs storagepolicies -listPolicies (2)为指定路径(数据存储目录)设置指定的存储策略 hdfs storagepolicies -setStoragePo

Hadoop集群数据均衡之磁盘间数据均衡

生产环境,由于硬盘空间不足,往往需要增加一块硬盘。刚加载的硬盘没有数据时,可以执行磁盘数据均衡命令。(Hadoop3.x新特性) plan后面带的节点的名字必须是已经存在的,并且是需要均衡的节点。 如果节点不存在,会报如下错误: 如果节点只有一个硬盘的话,不会创建均衡计划: (1)生成均衡计划 hdfs diskbalancer -plan hadoop102 (2)执行均衡计划 hd

【Prometheus】PromQL向量匹配实现不同标签的向量数据进行运算

✨✨ 欢迎大家来到景天科技苑✨✨ 🎈🎈 养成好习惯,先赞后看哦~🎈🎈 🏆 作者简介:景天科技苑 🏆《头衔》:大厂架构师,华为云开发者社区专家博主,阿里云开发者社区专家博主,CSDN全栈领域优质创作者,掘金优秀博主,51CTO博客专家等。 🏆《博客》:Python全栈,前后端开发,小程序开发,人工智能,js逆向,App逆向,网络系统安全,数据分析,Django,fastapi

烟火目标检测数据集 7800张 烟火检测 带标注 voc yolo

一个包含7800张带标注图像的数据集,专门用于烟火目标检测,是一个非常有价值的资源,尤其对于那些致力于公共安全、事件管理和烟花表演监控等领域的人士而言。下面是对此数据集的一个详细介绍: 数据集名称:烟火目标检测数据集 数据集规模: 图片数量:7800张类别:主要包含烟火类目标,可能还包括其他相关类别,如烟火发射装置、背景等。格式:图像文件通常为JPEG或PNG格式;标注文件可能为X

pandas数据过滤

Pandas 数据过滤方法 Pandas 提供了多种方法来过滤数据,可以根据不同的条件进行筛选。以下是一些常见的 Pandas 数据过滤方法,结合实例进行讲解,希望能帮你快速理解。 1. 基于条件筛选行 可以使用布尔索引来根据条件过滤行。 import pandas as pd# 创建示例数据data = {'Name': ['Alice', 'Bob', 'Charlie', 'Dav

SWAP作物生长模型安装教程、数据制备、敏感性分析、气候变化影响、R模型敏感性分析与贝叶斯优化、Fortran源代码分析、气候数据降尺度与变化影响分析

查看原文>>>全流程SWAP农业模型数据制备、敏感性分析及气候变化影响实践技术应用 SWAP模型是由荷兰瓦赫宁根大学开发的先进农作物模型,它综合考虑了土壤-水分-大气以及植被间的相互作用;是一种描述作物生长过程的一种机理性作物生长模型。它不但运用Richard方程,使其能够精确的模拟土壤中水分的运动,而且耦合了WOFOST作物模型使作物的生长描述更为科学。 本文让更多的科研人员和农业工作者