南京大数据技术Meetup第四次活动

2024-02-10 07:48

本文主要是介绍南京大数据技术Meetup第四次活动,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

很有幸今天去参加了“南京大数据技术Meetup第四次活动”,前三次由于不知道这样的活动,错过了非常可惜。以下就是我了解到的一些内容,在这里做一些记录:


1、   主要人员

a)  汪军(伦敦大学学院,博士生导师,教授,AI、互联网变现和计算广告学)

b)  王胤然(烽火通信大数据专家)

c)  张毅(苏宁云商,软件工程师)

d)  黄宜华(博士,教授,博导,NJUPASA实验室负责人)

e)  顾荣(NJU PH.D,PASA成员,Tachyon和SparkContributor)

f)  罗胜美(中国电子学会云计算专委会委员、中兴通讯集团首席架构师)

g)  樊建(华泰证券,南京载玄信息科技有限公司联合创始人,技术总监)


2、   行业应用

a)  苏宁云商:

                      i. 主要介绍了从2014年至今几大阶段的大数据技术演化;

                    ii. SQL on Storm à Storm Monitor à Libra … à Spark Streaming(内测)

                   iii. 资产管理、资源隔离、Docker的应用研究

b)  烽火安全云:

                      i. 主要介绍了从2010年至今大数据技术架构的情况;

                    ii. 互联网和信息安全这两个领域的大数据技术的主要区别;

                   iii. HBase的二级索引解决方案;

                   iv. 针对业务需要、屏蔽底层实现方案,向上层两个主要服务,分别为:queryService(查询引擎)和taskService(任务调度引擎)


3、   专家探讨

参与者: 樊建、汪军、黄宜华、罗胜美

5个topic:

a)  大数据在行业落地过程中主要存在哪些问题?(如大数据不易获取、大数据技术使用困难)?应当如何解决?

                      i. 罗:数据获取有多种途径,需要企业或研究者们,关注相关行业的情况,比如政府可以免费提供一段时间内的交通数据,给大家进行挖掘和分析研究等。之后,就要看如何使用这些数据和基于这些数据分析方法。

                    ii. 樊:对企业内部上百个项目的业务系统和存储数据的总体把握,是目前比较困难的地方。大数据系统的架构设计、开发和部署的落地是其次。

b)  预测大数据在未来两年可能会在哪几个行业进一步产生Killer App?

                      i. 樊:将传统的关系数据库的磁盘存储迁移到分布式文件系统上来,或者是基于内存级别的方式;还特别提到了后期对Docker的研究。

c)  大数据教育和人才培养方面有哪些建议和想法?(对学生和老师的建议)?

                      i. 黄:单位和高校的深度合作,定向培养;熟悉storm、spark等框架的部署、开发以及运维等系统性的知识。

d)  大数据技术和云计算技术的关系以及如何进一步理解?

                      i. 罗:云计算技术侧重的是存储和计算,而大数据技术侧重基于上层服务或应用的需求而产生的各种大数据解决方案。但从某种程度上来说,这两者确实存在一定的交差关系,这一层可以抽象为一个服务层,主要是基于云向上层提供的以及基于大数据业务向下层索取的特定实现。


4、   个人总结

今天的meet up让我受益很多,了解到南京地区的企业在大数据技术方面的实践历程和演化之路,尤其表现出了对Docker和Spark的研究和应用的关注。其中,企业要不要使用大数据,如何落地大数据技术,最后的效果又是如何的?都是值得深入思考的。

同时也让我看到了南京大学PASA实验室的强悍之处,作为实验室的成员,meet up的主持人,顾荣博士更是Spark和Tachyon的Contributor,他和他的导师黄教授合作开发了一个v0.1的大章鱼项目。科研与学术的结合,算法模型的多角度验证、offline数据的测试到online数据的证实,是发表顶级paper的前提和过程。

由此可见,国内的大数据技术氛围也是越来越好,最后听取了四位专家的座谈,通过对topics的回答,由浅入深地从学术角度和企业应用方面提出了各自的见解,确实开阔了视野,激起了我学习大数据技术的热情!


5、   相关链接

a)        http://pasa-bigdata.nju.edu.cn/

这篇关于南京大数据技术Meetup第四次活动的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/696542

相关文章

乐鑫 Matter 技术体验日|快速落地 Matter 产品,引领智能家居生态新发展

随着 Matter 协议的推广和普及,智能家居行业正迎来新的发展机遇,众多厂商纷纷投身于 Matter 产品的研发与验证。然而,开发者普遍面临技术门槛高、认证流程繁琐、生产管理复杂等诸多挑战。  乐鑫信息科技 (688018.SH) 凭借深厚的研发实力与行业洞察力,推出了全面的 Matter 解决方案,包含基于乐鑫 SoC 的 Matter 硬件平台、基于开源 ESP-Matter SDK 的一

一份LLM资源清单围观技术大佬的日常;手把手教你在美国搭建「百万卡」AI数据中心;为啥大模型做不好简单的数学计算? | ShowMeAI日报

👀日报&周刊合集 | 🎡ShowMeAI官网 | 🧡 点赞关注评论拜托啦! 1. 为啥大模型做不好简单的数学计算?从大模型高考数学成绩不及格说起 司南评测体系 OpenCompass 选取 7 个大模型 (6 个开源模型+ GPT-4o),组织参与了 2024 年高考「新课标I卷」的语文、数学、英语考试,然后由经验丰富的判卷老师评判得分。 结果如上图所

持久层 技术选型如何决策?JPA,Hibernate,ibatis(mybatis)

转自:http://t.51jdy.cn/thread-259-1-1.html 持久层 是一个项目 后台 最重要的部分。他直接 决定了 数据读写的性能,业务编写的复杂度,数据结构(对象结构)等问题。 因此 架构师在考虑 使用那个持久层框架的时候 要考虑清楚。 选择的 标准: 1,项目的场景。 2,团队的技能掌握情况。 3,开发周期(开发效率)。 传统的 业务系统,通常业

【服务器运维】MySQL数据存储至数据盘

查看磁盘及分区 [root@MySQL tmp]# fdisk -lDisk /dev/sda: 21.5 GB, 21474836480 bytes255 heads, 63 sectors/track, 2610 cylindersUnits = cylinders of 16065 * 512 = 8225280 bytesSector size (logical/physical)

亮相WOT全球技术创新大会,揭秘火山引擎边缘容器技术在泛CDN场景的应用与实践

2024年6月21日-22日,51CTO“WOT全球技术创新大会2024”在北京举办。火山引擎边缘计算架构师李志明受邀参与,以“边缘容器技术在泛CDN场景的应用和实践”为主题,与多位行业资深专家,共同探讨泛CDN行业技术架构以及云原生与边缘计算的发展和展望。 火山引擎边缘计算架构师李志明表示:为更好地解决传统泛CDN类业务运行中的问题,火山引擎边缘容器团队参考行业做法,结合实践经验,打造火山

SQL Server中,查询数据库中有多少个表,以及数据库其余类型数据统计查询

sqlserver查询数据库中有多少个表 sql server 数表:select count(1) from sysobjects where xtype='U'数视图:select count(1) from sysobjects where xtype='V'数存储过程select count(1) from sysobjects where xtype='P' SE

数据时代的数字企业

1.写在前面 讨论数据治理在数字企业中的影响和必要性,并介绍数据治理的核心内容和实践方法。作者强调了数据质量、数据安全、数据隐私和数据合规等方面是数据治理的核心内容,并介绍了具体的实践措施和案例分析。企业需要重视这些方面以实现数字化转型和业务增长。 数字化转型行业小伙伴可以加入我的星球,初衷成为各位数字化转型参考库,星球内容每周更新 个人工作经验资料全部放在这里,包含数据治理、数据要

如何在Java中处理JSON数据?

如何在Java中处理JSON数据? 大家好,我是免费搭建查券返利机器人省钱赚佣金就用微赚淘客系统3.0的小编,也是冬天不穿秋裤,天冷也要风度的程序猿!今天我们将探讨在Java中如何处理JSON数据。JSON(JavaScript Object Notation)作为一种轻量级的数据交换格式,在现代应用程序中被广泛使用。Java通过多种库和API提供了处理JSON的能力,我们将深入了解其用法和最佳

两个基因相关性CPTAC蛋白组数据

目录 蛋白数据下载 ①蛋白数据下载 1,TCGA-选择泛癌数据  2,TCGA-TCPA 3,CPTAC(非TCGA) ②蛋白相关性分析 1,数据整理 2,蛋白相关性分析 PCAS在线分析 蛋白数据下载 CPTAC蛋白组学数据库介绍及数据下载分析 – 王进的个人网站 (jingege.wang) ①蛋白数据下载 可以下载泛癌蛋白数据:UCSC Xena (xena

中国341城市生态系统服务价值数据集(2000-2020年)

生态系统服务反映了人类直接或者间接从自然生态系统中获得的各种惠益,对支撑和维持人类生存和福祉起着重要基础作用。目前针对全国城市尺度的生态系统服务价值的长期评估还相对较少。我们在Xie等(2017)的静态生态系统服务当量因子表基础上,选取净初级生产力,降水量,生物迁移阻力,土壤侵蚀度和道路密度五个变量,对生态系统供给服务、调节服务、支持服务和文化服务共4大类和11小类的当量因子进行了时空调整,计算了