清华韩亦舜:大数据革命与新经济分析

2023-11-05 20:30

本文主要是介绍清华韩亦舜:大数据革命与新经济分析,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!


0?wx_fmt=jpeg


 ◆ 


导读:本讲座为清华大学数据科学研究院执行副院长韩亦舜于2016年7月14日在首届中国大数据应用大会上所做的题为《大数据革命与新经济分析》的演讲。


0?wx_fmt=png

0?wx_fmt=png


 ◆ 


我们研究经济的时候,一定会放眼世界看更大的版图,因为今天的中国已经是世界第二大经济体了。看这张图的时候大家想一想,如果没有互联网,我们不可能及时地看到这个世界。80年代,电话开始进入了普通中国家庭。但是数量还是很少,通讯基本还是靠书信。现在信息发展非常快,这就要求我们思考:当我们放眼世界的时候,以什么样的思想和工具观察这个世界?


0?wx_fmt=png

0?wx_fmt=png

0?wx_fmt=png

0?wx_fmt=png


这些大数据的发展历程大家已经耳熟能详了。大数据分析未来的发展趋势是:数据将应用于社会化的分析,工具会越来越灵活;越来越多的人借助可视化方法来表现数据魅力,可视化做好以后数据会有美感方面的创新。数据的搜集将不但来自特定机构的数据,也来自老百姓的无私奉献。我们知道,每个人在网上随便一个动作都能留下很多痕迹,特别是当有些机制会让民众以很自然的方式参与公共数据的采集,这会减少政府维护基础设施的成本,也让市民有很好的参与感。大数据叠加上互联网、云计算,会带来新机遇。



0?wx_fmt=png

0?wx_fmt=png


今天我希望讲一讲大数据和经济分析的关系,过去我们有宏观经济、微观经济,今后经济研究领域会越来越注重用数据说话,数据会给我们呈现什么东西呢?


关于大数据只重视相关性不重视因果性,这个说法有片面性。数据表明海盗数量减少和全球气候变暖高度相关,可这有什么用?我们不能把全球气温抬高来遏制海盗数量。人类现在的思维水平更多地可能还是愿意找一些因果关系才能重复使用,包括结构化和非结构化,目前很多科学家做的努力都是把非结构化的数据结构化或半结构化,就是因为目前我们的认知水平多数还是用结构化的方式处理更有效和更习惯。


0?wx_fmt=png


我们尝试用大数据处理手段做行业分析,开发出一些行业指数。这些数据一定不是交易数据的全部,但是经过持续采集、连续分析,当它作为一个行业指数来说还是有比较好的参考价值的。这里面我们着重做了一些行业相关的指数。今天我说的数据主要来自银联刷卡数据,它有一定的代表性。当然第一,大家知道外国的卡不归它管;第二,现金交易不归它管,第三方支付也拿不到数据,所以采集到的数据仍然不是全面数据。但即便不是全面数据也可以呈现出一些比较有趣的现象。


0?wx_fmt=png


这是房地产数据,虽然和传统统计方式不太一样,它确实呈现出与国家统计局公布的数据拟合度很高的情形。而且,我们的实时性很强,这些数据对于一些想提前知道经济状况,想提前对经济进行预测的金融机构还是有很大价值的。


0?wx_fmt=png


这是一个高端酒店的行业数据,这是以2011年的数据做基准,黄色的曲线可以看出它的起伏。灰色的竖道是环比增长情况。


0?wx_fmt=png

0?wx_fmt=png


这里面有三个数,一个是餐饮指数增长增速,一个是酒店增速,和各省GDP的增速。里面可以看到全部是深红色的地方是西藏这个地方,酒店指数这块——青海、新疆发展很快,包括贵州、广西也都发展得比较快。在整个沿海地区呈现出相对发展较慢的情况,但是那边的经济并不是想象的那么差,只不过它的餐饮业酒店业饱和度比较高,所以就没有呈现出那么好的增长趋势。


0?wx_fmt=png


这张图说明了什么?刚才介绍了几本书,其中讲到了区域相关性,我们有几个大的经济区域,它们之间存在着什么样的经济关系,我们也用手上的数据进行分析,呈现出类似一些情况。


0?wx_fmt=png

前不久我们做了一个大数据交流会,和韩国的学者一起交流。我们利用跨境交易数据做了统计,2013年—2015年跨境交易金额数据香港第一,澳门第二,韩国从2014年的第三掉到2015年的第五,2015年日本从后面又赶上来了,这是不是背后有可以解释或者暂时不能解释的原因?另外是交易笔数,香港第一,到2015年韩国第二,日本第三,这说明什么呢?说明在韩国买的都是小件东西,所以交易笔数多但是金额不多,在日本买的都是大件东西,交易笔数相对少一点,但是交易总额多一些。这就是我想说的,有的时候当你利用手上一部分数据,分析它会发现一些比较奇特的现象。



0?wx_fmt=png


这个是日韩跨境消费数据,主要集中在珠宝百货与美容行业,韩国珠宝类的交易几乎不太多,特别突出的是韩国行业的美容,这个和大家的认知差不多,很多人去韩国购买深度或者浅层的美容服务,但是在那儿买珠宝的很少。我们展示这个数据并和韩国学者交流,他们承认他们的珠宝类产业不够发达,据说和他们国家的珠宝加工水平不高有关,这些数据是不是反过来指出规划产业的时候在这些略有不足的地方存在发展空间,这对他们也有指导意义。


0?wx_fmt=png


这是中日韩消费经济呈现区域引力效应图,竖向是在几地的消费,横向是三个月后又在这些地方消费。红色的框是三个月出现在香港消费,三个月又出现在香港消费的比较多,泰国只有百分之七点多,法国百分之八点几,瑞士只有百分之四,美国有百分之二十多,其中是什么原因不敢轻易下结论。这里面有几个蓝框,讲区域引力效应,香港和澳门框的比例相对高一些,日本和韩国的框整体又是在百分之十几以上,另外就是法国和瑞士,前面讲的几本书,其中有一本讲到了区域经济引力,相邻地区或者风格相近的地方因为对彼此的风格很认同,所以愿意再去。如果我们对这种问题一探究竟会很有趣,比如为什么去过香港以后去澳门就多一些,这些都可以做一些深入探讨。


0?wx_fmt=png

0?wx_fmt=png

原文发布时间为:2016-08-07

本文来自云栖社区合作伙伴“大数据文摘”,了解相关信息可以关注“BigDataDigest”微信公众号

这篇关于清华韩亦舜:大数据革命与新经济分析的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/352319

相关文章

python处理带有时区的日期和时间数据

《python处理带有时区的日期和时间数据》这篇文章主要为大家详细介绍了如何在Python中使用pytz库处理时区信息,包括获取当前UTC时间,转换为特定时区等,有需要的小伙伴可以参考一下... 目录时区基本信息python datetime使用timezonepandas处理时区数据知识延展时区基本信息

Qt实现网络数据解析的方法总结

《Qt实现网络数据解析的方法总结》在Qt中解析网络数据通常涉及接收原始字节流,并将其转换为有意义的应用层数据,这篇文章为大家介绍了详细步骤和示例,感兴趣的小伙伴可以了解下... 目录1. 网络数据接收2. 缓冲区管理(处理粘包/拆包)3. 常见数据格式解析3.1 jsON解析3.2 XML解析3.3 自定义

SpringMVC 通过ajax 前后端数据交互的实现方法

《SpringMVC通过ajax前后端数据交互的实现方法》:本文主要介绍SpringMVC通过ajax前后端数据交互的实现方法,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价... 在前端的开发过程中,经常在html页面通过AJAX进行前后端数据的交互,SpringMVC的controll

Pandas统计每行数据中的空值的方法示例

《Pandas统计每行数据中的空值的方法示例》处理缺失数据(NaN值)是一个非常常见的问题,本文主要介绍了Pandas统计每行数据中的空值的方法示例,具有一定的参考价值,感兴趣的可以了解一下... 目录什么是空值?为什么要统计空值?准备工作创建示例数据统计每行空值数量进一步分析www.chinasem.cn处

如何使用 Python 读取 Excel 数据

《如何使用Python读取Excel数据》:本文主要介绍使用Python读取Excel数据的详细教程,通过pandas和openpyxl,你可以轻松读取Excel文件,并进行各种数据处理操... 目录使用 python 读取 Excel 数据的详细教程1. 安装必要的依赖2. 读取 Excel 文件3. 读

Spring 请求之传递 JSON 数据的操作方法

《Spring请求之传递JSON数据的操作方法》JSON就是一种数据格式,有自己的格式和语法,使用文本表示一个对象或数组的信息,因此JSON本质是字符串,主要负责在不同的语言中数据传递和交换,这... 目录jsON 概念JSON 语法JSON 的语法JSON 的两种结构JSON 字符串和 Java 对象互转

C++如何通过Qt反射机制实现数据类序列化

《C++如何通过Qt反射机制实现数据类序列化》在C++工程中经常需要使用数据类,并对数据类进行存储、打印、调试等操作,所以本文就来聊聊C++如何通过Qt反射机制实现数据类序列化吧... 目录设计预期设计思路代码实现使用方法在 C++ 工程中经常需要使用数据类,并对数据类进行存储、打印、调试等操作。由于数据类

SpringBoot使用GZIP压缩反回数据问题

《SpringBoot使用GZIP压缩反回数据问题》:本文主要介绍SpringBoot使用GZIP压缩反回数据问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录SpringBoot使用GZIP压缩反回数据1、初识gzip2、gzip是什么,可以干什么?3、Spr

Java程序进程起来了但是不打印日志的原因分析

《Java程序进程起来了但是不打印日志的原因分析》:本文主要介绍Java程序进程起来了但是不打印日志的原因分析,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录Java程序进程起来了但是不打印日志的原因1、日志配置问题2、日志文件权限问题3、日志文件路径问题4、程序

Java字符串操作技巧之语法、示例与应用场景分析

《Java字符串操作技巧之语法、示例与应用场景分析》在Java算法题和日常开发中,字符串处理是必备的核心技能,本文全面梳理Java中字符串的常用操作语法,结合代码示例、应用场景和避坑指南,可快速掌握字... 目录引言1. 基础操作1.1 创建字符串1.2 获取长度1.3 访问字符2. 字符串处理2.1 子字