Python数据分析——谁才是《三体》的主角?

2023-11-22 16:30

本文主要是介绍Python数据分析——谁才是《三体》的主角?,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

准备工作

matplotlib库

三体.txt(utf-8编码)

三体主要人物.txt(utf-8编码)

代码

大纲

导入matplotlib.pyplot方法,创建1个Novel类,包含2个属性和4个方法。

import matplotlib.pyplot as pltclass Novel():"""创建一个小说的类"""def __init__(self, novel_name, roles_name):"""初始化类的属性"""def one_role_nums(self, role_name):"""统计一个人物名字出现的次数"""def main_roles_nums(self):"""统计主要人物名字出现的次数"""def show_datas(self):"""输出人物名字及出现次数"""def draw_picture(self, title = ""):"""可视化数据"""

初始化

类包含两个属性,小说名字和主要人物名字。

主要人物来源于《三体》百度百科,以每行一个名字的格式存储于txt文档,如下图。

注:艾aa的名字采用aa,因小说中多称呼aa。

def __init__(self, novel_name, roles_name):"""初始化类的属性"""self.novel_name = novel_nameself.roles_name = roles_name

方法

one_role_nums方法

def one_role_nums(self, role_name):"""统计一个人物名字出现的次数"""with open(self.novel_name, encoding = 'utf-8') as f:content = f.read()count = 0n = len(role_name)for i in range(len(content)):if content[i : i + n] == role_name:count += 1return count

main_roles_nums方法

返回一个列表,列表元素为字典中的键值对且按value降序排列。

def main_roles_nums(self):"""统计主要人物名字出现的次数"""with open(self.roles_name, encoding = 'utf-8') as f:names = [line.strip() for line in f.readlines()]dic = {}                    for name in names:num = self.one_role_nums(name)if num:dic[name] = numdic = sorted(dic.items(), key = lambda k : k[1], reverse = True)return dic

show_datas方法

def show_datas(self):"""输出人物名字及出现次数"""dic = self.main_roles_nums()for x in dic:print(x[0], x[1])

draw_picture方法

运用matplotlib库将所得数据可视化。

调用方法时可赋予一个标题,默认为空。

def draw_picture(self, title = ""):"""可视化数据"""dic = self.main_roles_nums()names, nums = [], []for x in dic:names.append(x[0])nums.append(x[1])n = list(range(len(names)))plt.figure(figsize=(10, 6))    plt.bar(n, nums, alpha=0.5)plt.xlim((0, len(names)))plt.xticks(n, names, rotation = 30, fontproperties = "SimHei", fontsize = 24)plt.title(title, fontproperties = "SimHei", fontsize = 40)plt.show()

调用

创建一个对象,赋予两个属性。

novel = Novel("三体.txt", "三体主要人物.txt")   

调用方法show_datas()

novel.show_datas()

调用方法draw_picture()并赋予一个标题

novel.draw_picture("三体主要人物名字出现次数")


结果符合预期,汪淼、罗辑和程心是当之无愧的三大主角,且随着《三体I》《三体II》《三体III》小说的篇幅增多而名字出现次数增多。

其他人物名字出现的次数基本与观感相符合。

分析射雕三部曲

再以同样的方法分析射雕三部曲,可以发现,张无忌主角光环最甚。

dic = {"射雕英雄传.txt":"射雕英雄传主要人物.txt", "神雕侠侣.txt":"神雕侠侣主要人物.txt", "倚天屠龙记.txt":"倚天屠龙记主要人物.txt"} 
for key, value in dic.items():novel = Novel(key, value)novel.draw_picture()

射雕英雄传

mark

神雕侠侣

mark

倚天屠龙记

mark

GitHub

https://github.com/ruansh/Three-body-roles

这篇关于Python数据分析——谁才是《三体》的主角?的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/411423

相关文章

使用Python将PDF表格自动提取并写入Word文档表格

《使用Python将PDF表格自动提取并写入Word文档表格》在实际办公与数据处理场景中,PDF文件里的表格往往无法直接复制到Word中,本文将介绍如何使用Python从PDF文件中提取表格数据,并将... 目录引言1. 加载 PDF 文件并准备 Word 文档2. 提取 PDF 表格并创建 Word 表格

使用Python实现局域网远程监控电脑屏幕的方法

《使用Python实现局域网远程监控电脑屏幕的方法》文章介绍了两种使用Python在局域网内实现远程监控电脑屏幕的方法,方法一使用mss和socket,方法二使用PyAutoGUI和Flask,每种方... 目录方法一:使用mss和socket实现屏幕共享服务端(被监控端)客户端(监控端)方法二:使用PyA

Python列表的创建与删除的操作指南

《Python列表的创建与删除的操作指南》列表(list)是Python中最常用、最灵活的内置数据结构之一,它支持动态扩容、混合类型、嵌套结构,几乎无处不在,但你真的会创建和删除列表吗,本文给大家介绍... 目录一、前言二、列表的创建方式1. 字面量语法(最常用)2. 使用list()构造器3. 列表推导式

Python使用Matplotlib和Seaborn绘制常用图表的技巧

《Python使用Matplotlib和Seaborn绘制常用图表的技巧》Python作为数据科学领域的明星语言,拥有强大且丰富的可视化库,其中最著名的莫过于Matplotlib和Seaborn,本篇... 目录1. 引言:数据可视化的力量2. 前置知识与环境准备2.1. 必备知识2.2. 安装所需库2.3

Python数据验证神器Pydantic库的使用和实践中的避坑指南

《Python数据验证神器Pydantic库的使用和实践中的避坑指南》Pydantic是一个用于数据验证和设置的库,可以显著简化API接口开发,文章通过一个实际案例,展示了Pydantic如何在生产环... 目录1️⃣ 崩溃时刻:当你的API接口又双叒崩了!2️⃣ 神兵天降:3行代码解决验证难题3️⃣ 深度

Python+FFmpeg实现视频自动化处理的完整指南

《Python+FFmpeg实现视频自动化处理的完整指南》本文总结了一套在Python中使用subprocess.run调用FFmpeg进行视频自动化处理的解决方案,涵盖了跨平台硬件加速、中间素材处理... 目录一、 跨平台硬件加速:统一接口设计1. 核心映射逻辑2. python 实现代码二、 中间素材处

python中的flask_sqlalchemy的使用及示例详解

《python中的flask_sqlalchemy的使用及示例详解》文章主要介绍了在使用SQLAlchemy创建模型实例时,通过元类动态创建实例的方式,并说明了如何在实例化时执行__init__方法,... 目录@orm.reconstructorSQLAlchemy的回滚关联其他模型数据库基本操作将数据添

Python实现快速扫描目标主机的开放端口和服务

《Python实现快速扫描目标主机的开放端口和服务》这篇文章主要为大家详细介绍了如何使用Python编写一个功能强大的端口扫描器脚本,实现快速扫描目标主机的开放端口和服务,感兴趣的小伙伴可以了解下... 目录功能介绍场景应用1. 网络安全审计2. 系统管理维护3. 网络故障排查4. 合规性检查报错处理1.

Python轻松实现Word到Markdown的转换

《Python轻松实现Word到Markdown的转换》在文档管理、内容发布等场景中,将Word转换为Markdown格式是常见需求,本文将介绍如何使用FreeSpire.DocforPython实现... 目录一、工具简介二、核心转换实现1. 基础单文件转换2. 批量转换Word文件三、工具特性分析优点局

Python中4大日志记录库比较的终极PK

《Python中4大日志记录库比较的终极PK》日志记录框架是一种工具,可帮助您标准化应用程序中的日志记录过程,:本文主要介绍Python中4大日志记录库比较的相关资料,文中通过代码介绍的非常详细,... 目录一、logging库1、优点2、缺点二、LogAid库三、Loguru库四、Structlogphp