5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

本文主要是介绍5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

友情提示:文末有...

一次完整的python分析+可视化展示,是什么样的?

比如我想知道知乎用户的学历,是否都是985呢?我还想知道知乎最受关注的话题都是些什么?高端人士都喜欢看什么书呢?“人在XX,刚下飞机?”这句话出现的频率有多高呢?

最快的方法是用python爬虫然后加BI可视化分析!python爬虫仅需几步就可以完成:

  • 找到网页URL,查看HTML代码
  • 在HTML代码中找到你要提取的数据
  • 写python进行网页请求和解析
  • 存储数据,Excel导出

 

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

于是我使用10000秒的时间写了5000行代码,爬取了知乎下5646个话题与回答,10W+用户,和我预想的结果完全不一样。

我们先放一部分代码,完整的可以到文末看评论~

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

最后爬取了大概快60W的数据,我们接下来要对它进行数字可视化的分析。

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

我们想通过数据知道什么?

  • 知乎人均985吗?
  • 知乎最受关注的话题是哪些?这些话题的关系图谱是怎么样的?
  • 知乎大佬最推荐的书是哪些?
  • 知乎的娱乐栏目最受关注的都是哪些?

在分析之前,我们得挑选一个数据可视化工具,有人会问:为什么不用python呢?因为python处理数据或许很不错,但其实它并不简单,分析起来是很困难的,SQL语句、Pandas和Matplotlib这些十分繁琐,一般人也不会。

所以我想到既然有现成数据的话,那选择一个可以直接连接数据源的工具就更好了,我想到了BI里的佼佼者FineBI,轻便敏捷的数据分析能力,浏览器里就可以直接操作,而且对于大数据量可以及时响应,直接拖拽即可生成可视化。

虽然主打的是企业级的数据分析工具,但是个人也是可以用的,而且是free的,功能并不会减少,可谓良心。很多企业依然有各种各样的数据问题:IT-业务沟通困难,领导决策缺乏数据支撑....

FineBI从IT、业务、管理层三个方面去解决问题:

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

通过自助数据集功能,普通业务人员就能对数据做筛选、切割、排序、汇总等,自助灵活地达成期望的数据结果。

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

BI工具就介绍到这里,接下来我们看知乎的可视化分析,以下都是由FineBI所作。

1、知乎是否人均985?

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

一看这个学校,我自卑了!!!果真人均985,211,怪不得知乎上很多回答都显得很有哲理的样子,果然,学历越高的人见识越多,看来好好学习真的很重要。不过,我说知乎的学历比虎扑高没有人反对吧。

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

当然,这些数据的前提都是基于你自己填写的是准确的,大专给自己填哈佛我也没办法...

2、知乎最受关注的话题是哪些?

大佬们上知乎,都会去浏览什么问题呢?就拿数据领域来说,这两份关系图可以说是最全的了,如果你想从0-1进入数据行业,这是一个很好的基础学习方向。

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

3、知乎大佬最推荐的书是哪些?

读万卷书,行万里路,没点知识怎么好意思刷知乎呢?

我把所有关于文学书籍推荐的问题都爬了一遍,统计下来就是这10本书排名前列,很遗憾,我只看过1本...

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

4、在娱乐类目上,知乎的人都喜欢关注什么呢?

5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事

 

其实和微博一样,知乎也算是一个获取知识的平台,而且现在越来越多的人都把知乎当作微博来看,评论区的智商会高很多(我没有别的意思)。

一直流传着一句话:微博前脚火什么,知乎后脚扒什么...真实!

总结

知乎的分析就到这里了,你可以看见python+finebi真的就是非常棒的组合,无论是数据处理,还是数据展示,想要分析什么,简直就是手到擒来!

最后,以上的分析如果有不足的地方,欢迎告诉我!

关注我,并转发该文章,私信回复“BI”,即可获得数据分析工具和源代码!

这篇关于5000行python代码+可视化60W数据,告诉你知乎用户不为人知的事的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/782050

相关文章

Python实现特殊字符判断并去掉非字母和数字的特殊字符

《Python实现特殊字符判断并去掉非字母和数字的特殊字符》在Python中,可以通过多种方法来判断字符串中是否包含非字母、数字的特殊字符,并将这些特殊字符去掉,本文为大家整理了一些常用的,希望对大家... 目录1. 使用正则表达式判断字符串中是否包含特殊字符去掉字符串中的特殊字符2. 使用 str.isa

python中各种常见文件的读写操作与类型转换详细指南

《python中各种常见文件的读写操作与类型转换详细指南》这篇文章主要为大家详细介绍了python中各种常见文件(txt,xls,csv,sql,二进制文件)的读写操作与类型转换,感兴趣的小伙伴可以跟... 目录1.文件txt读写标准用法1.1写入文件1.2读取文件2. 二进制文件读取3. 大文件读取3.1

使用Python实现一个优雅的异步定时器

《使用Python实现一个优雅的异步定时器》在Python中实现定时器功能是一个常见需求,尤其是在需要周期性执行任务的场景下,本文给大家介绍了基于asyncio和threading模块,可扩展的异步定... 目录需求背景代码1. 单例事件循环的实现2. 事件循环的运行与关闭3. 定时器核心逻辑4. 启动与停

基于Python实现读取嵌套压缩包下文件的方法

《基于Python实现读取嵌套压缩包下文件的方法》工作中遇到的问题,需要用Python实现嵌套压缩包下文件读取,本文给大家介绍了详细的解决方法,并有相关的代码示例供大家参考,需要的朋友可以参考下... 目录思路完整代码代码优化思路打开外层zip压缩包并遍历文件:使用with zipfile.ZipFil

Python处理函数调用超时的四种方法

《Python处理函数调用超时的四种方法》在实际开发过程中,我们可能会遇到一些场景,需要对函数的执行时间进行限制,例如,当一个函数执行时间过长时,可能会导致程序卡顿、资源占用过高,因此,在某些情况下,... 目录前言func-timeout1. 安装 func-timeout2. 基本用法自定义进程subp

Python实现word文档内容智能提取以及合成

《Python实现word文档内容智能提取以及合成》这篇文章主要为大家详细介绍了如何使用Python实现从10个左右的docx文档中抽取内容,再调整语言风格后生成新的文档,感兴趣的小伙伴可以了解一下... 目录核心思路技术路径实现步骤阶段一:准备工作阶段二:内容提取 (python 脚本)阶段三:语言风格调

Python结合PyWebView库打造跨平台桌面应用

《Python结合PyWebView库打造跨平台桌面应用》随着Web技术的发展,将HTML/CSS/JavaScript与Python结合构建桌面应用成为可能,本文将系统讲解如何使用PyWebView... 目录一、技术原理与优势分析1.1 架构原理1.2 核心优势二、开发环境搭建2.1 安装依赖2.2 验

使用Java将DOCX文档解析为Markdown文档的代码实现

《使用Java将DOCX文档解析为Markdown文档的代码实现》在现代文档处理中,Markdown(MD)因其简洁的语法和良好的可读性,逐渐成为开发者、技术写作者和内容创作者的首选格式,然而,许多文... 目录引言1. 工具和库介绍2. 安装依赖库3. 使用Apache POI解析DOCX文档4. 将解析

一文详解如何在Python中从字符串中提取部分内容

《一文详解如何在Python中从字符串中提取部分内容》:本文主要介绍如何在Python中从字符串中提取部分内容的相关资料,包括使用正则表达式、Pyparsing库、AST(抽象语法树)、字符串操作... 目录前言解决方案方法一:使用正则表达式方法二:使用 Pyparsing方法三:使用 AST方法四:使用字

C++使用printf语句实现进制转换的示例代码

《C++使用printf语句实现进制转换的示例代码》在C语言中,printf函数可以直接实现部分进制转换功能,通过格式说明符(formatspecifier)快速输出不同进制的数值,下面给大家分享C+... 目录一、printf 原生支持的进制转换1. 十进制、八进制、十六进制转换2. 显示进制前缀3. 指