使用python开发的词云图生成器2.0

2024-05-01 18:52

本文主要是介绍使用python开发的词云图生成器2.0,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

使用python开发的词云图生成器2.0

  • 更新部分
  • 词云图
  • 主要三方库
  • 工具介绍和效果
    • 工具界面:
  • 代码

更新部分

1.支持选择字体;
2.支持选择词云图形状

词云图

词云图啊,简单来说,它可以把文本数据中的高频关键词变成不同大小、颜色的词汇,然后像云朵一样聚集在一起。如下图所示:
在这里插入图片描述
在这里插入图片描述

主要三方库

  • pyqt开发gui界面
  • jieba库进行分词
  • matplotlib库展示词云图
  • wordcloud库生成词云图

工具介绍和效果

工具界面:

在这里插入图片描述

代码

"""
楷体:simkai.ttf
隶书:SIMLI.TTF
宋体:simsun.ttc
黑体:simhei.ttf
微软雅黑:msyh.ttc"""
import sys
from PyQt5.QtWidgets import QApplication, QWidget, QVBoxLayout, QHBoxLayout, QPushButton, QSizePolicy, QFileDialog, \QColorDialog, QComboBox
from matplotlib.backends.backend_qt5agg import FigureCanvasQTAgg as FigureCanvas
from matplotlib.figure import Figure
from wordcloud import WordCloud
import jieba
import numpy as np
from PIL import Imageclass MainWindow(QWidget):def __init__(self):super().__init__()self.color_code = Noneself.mask_shape = Noneself.ch_font = Noneself.initUI()def initUI(self):self.font_dict = {'楷体': 'simkai.ttf', '隶书': 'SIMLI.TTF', '宋体': 'simsun.ttc', '黑体': 'simhei.ttf','微软雅黑': 'msyh.ttc'}# 创建布局vbox = QVBoxLayout()# 第一部分:横向排列的四个按钮button_list = ["选择文本", "选择停用词", "选择背景颜色", "导出词云图", "选择词云图形状", "选择字体"]self.font_type = QComboBox(self)# 遍历字典的键,并将它们添加到 QComboBox 中for key in self.font_dict:self.font_type.addItem(key)hbox1 = QHBoxLayout()for i in range(6):btn = QPushButton(button_list[i])if button_list[i] == "选择文本":btn.clicked.connect(self.openTextFile)elif button_list[i] == "选择停用词":btn.clicked.connect(self.openStopWordsFile)elif button_list[i] == "选择背景颜色":btn.setObjectName("选择背景颜色")btn.clicked.connect(self.selectBackgroundColor)elif button_list[i] == "选择词云图形状":btn.setObjectName("选择词云图形状")btn.clicked.connect(self.open_mask_img)else:btn.clicked.connect(self.save_wordcloud_image)hbox1.addWidget(btn)hbox1.addWidget(self.font_type)vbox.addLayout(hbox1)# 第二部分:一个按钮btn_single = QPushButton('更新词云图')btn_single.clicked.connect(self.update_wordcloud)  # 连接点击事件vbox.addWidget(btn_single)# 第三部分:matplotlib绘制的折线图(假设MatplotlibCanvas已定义)self.fig = Figure(figsize=(8, 8), dpi=100)self.axes = self.fig.add_subplot(111)self.canvas = FigureCanvas(self.fig)vbox.addWidget(self.canvas)  # 将画布添加到布局中# 设置窗口属性self.setLayout(vbox)self.setWindowTitle('词云图生成器V2.0')self.setGeometry(500, 300, 800, 640)self.show()def open_mask_img(self):options = QFileDialog.Options()options |= QFileDialog.DontUseNativeDialogfileName, _ = QFileDialog.getOpenFileName(self, "选择词云图形状", "","Image Files (*.png *.xpm *.jpg *.jpeg)",options=options)if fileName:self.mask_shape = np.array(Image.open(fileName))def save_wordcloud_image(self):options = QFileDialog.Options()options |= QFileDialog.DontUseNativeDialogfileName, _ = QFileDialog.getSaveFileName(self, "保存词云图", "","PNG Files (*.png);;JPG Files (*.jpg);;All Files (*)",options=options)if fileName:self.fig.savefig(fileName, dpi=100, bbox_inches='tight')print(f"词云图已保存为 {fileName}")def update_wordcloud(self):# 字体选择selected_text = self.font_type.currentText()# 使用字典的键来检索对应的值self.ch_font = self.font_dict[selected_text]# 使用jieba进行分词word_list = jieba.cut(self.text, cut_all=False)words = " ".join(word_list)# 设置matplotlib使用支持中文的字体# 创建WordCloud对象并生成词云图print(self.color_code)wordcloud = WordCloud(width=800, height=800,background_color=self.color_code if self.color_code is not None else "white", \stopwords=None, font_path=self.ch_font if self.ch_font is not None else 'msyh.ttc',mask=self.mask_shape if self.mask_shape is not None else None).generate(words)# 清除之前的图像并绘制新的词云图self.axes.clear()self.axes.imshow(wordcloud, interpolation='bilinear')self.axes.axis("off")self.canvas.draw()def openTextFile(self):"""打开文件选择对话框,选择文本文件"""self.file_path, _ = QFileDialog.getOpenFileName(self, "选择文本文件", "", "Text Files (*.txt)")if self.file_path:  # 确保文件路径不为空with open(self.file_path, 'r', encoding='utf-8') as file:  # 读取文本文件内容self.text = file.read()# 自动更新词云图else:print("未选择文件")def openStopWordsFile(self):"""打开文件选择对话框,选择停用词文件"""file_path, _ = QFileDialog.getOpenFileName(self, "选择停用词文件", "", "Text Files (*.txt)")# 这里添加处理文件路径的逻辑with open(file_path, 'r', encoding='utf-8') as f:stopwords = set(f.read().splitlines())print(stopwords)def selectBackgroundColor(self):"""打开颜色选择器,选择背景颜色"""color = QColorDialog.getColor()if color.isValid():# 更新按钮文本为颜色代码self.color_code = color.name()button = self.findChild(QPushButton, "选择背景颜色")button.setText(self.color_code)# 更新按钮文本颜色button.setStyleSheet(f"color: {self.color_code};")# 这里添加使用所选颜色的逻辑if __name__ == '__main__':app = QApplication(sys.argv)ex = MainWindow()sys.exit(app.exec_())

这篇关于使用python开发的词云图生成器2.0的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/952425

相关文章

C++使用栈实现括号匹配的代码详解

《C++使用栈实现括号匹配的代码详解》在编程中,括号匹配是一个常见问题,尤其是在处理数学表达式、编译器解析等任务时,栈是一种非常适合处理此类问题的数据结构,能够精确地管理括号的匹配问题,本文将通过C+... 目录引言问题描述代码讲解代码解析栈的状态表示测试总结引言在编程中,括号匹配是一个常见问题,尤其是在

Python调用Orator ORM进行数据库操作

《Python调用OratorORM进行数据库操作》OratorORM是一个功能丰富且灵活的PythonORM库,旨在简化数据库操作,它支持多种数据库并提供了简洁且直观的API,下面我们就... 目录Orator ORM 主要特点安装使用示例总结Orator ORM 是一个功能丰富且灵活的 python O

Java中String字符串使用避坑指南

《Java中String字符串使用避坑指南》Java中的String字符串是我们日常编程中用得最多的类之一,看似简单的String使用,却隐藏着不少“坑”,如果不注意,可能会导致性能问题、意外的错误容... 目录8个避坑点如下:1. 字符串的不可变性:每次修改都创建新对象2. 使用 == 比较字符串,陷阱满

Python使用国内镜像加速pip安装的方法讲解

《Python使用国内镜像加速pip安装的方法讲解》在Python开发中,pip是一个非常重要的工具,用于安装和管理Python的第三方库,然而,在国内使用pip安装依赖时,往往会因为网络问题而导致速... 目录一、pip 工具简介1. 什么是 pip?2. 什么是 -i 参数?二、国内镜像源的选择三、如何

使用C++实现链表元素的反转

《使用C++实现链表元素的反转》反转链表是链表操作中一个经典的问题,也是面试中常见的考题,本文将从思路到实现一步步地讲解如何实现链表的反转,帮助初学者理解这一操作,我们将使用C++代码演示具体实现,同... 目录问题定义思路分析代码实现带头节点的链表代码讲解其他实现方式时间和空间复杂度分析总结问题定义给定

Linux使用nload监控网络流量的方法

《Linux使用nload监控网络流量的方法》Linux中的nload命令是一个用于实时监控网络流量的工具,它提供了传入和传出流量的可视化表示,帮助用户一目了然地了解网络活动,本文给大家介绍了Linu... 目录简介安装示例用法基础用法指定网络接口限制显示特定流量类型指定刷新率设置流量速率的显示单位监控多个

JavaScript中的reduce方法执行过程、使用场景及进阶用法

《JavaScript中的reduce方法执行过程、使用场景及进阶用法》:本文主要介绍JavaScript中的reduce方法执行过程、使用场景及进阶用法的相关资料,reduce是JavaScri... 目录1. 什么是reduce2. reduce语法2.1 语法2.2 参数说明3. reduce执行过程

如何使用Java实现请求deepseek

《如何使用Java实现请求deepseek》这篇文章主要为大家详细介绍了如何使用Java实现请求deepseek功能,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 目录1.deepseek的api创建2.Java实现请求deepseek2.1 pom文件2.2 json转化文件2.2

python使用fastapi实现多语言国际化的操作指南

《python使用fastapi实现多语言国际化的操作指南》本文介绍了使用Python和FastAPI实现多语言国际化的操作指南,包括多语言架构技术栈、翻译管理、前端本地化、语言切换机制以及常见陷阱和... 目录多语言国际化实现指南项目多语言架构技术栈目录结构翻译工作流1. 翻译数据存储2. 翻译生成脚本

Android 悬浮窗开发示例((动态权限请求 | 前台服务和通知 | 悬浮窗创建 )

《Android悬浮窗开发示例((动态权限请求|前台服务和通知|悬浮窗创建)》本文介绍了Android悬浮窗的实现效果,包括动态权限请求、前台服务和通知的使用,悬浮窗权限需要动态申请并引导... 目录一、悬浮窗 动态权限请求1、动态请求权限2、悬浮窗权限说明3、检查动态权限4、申请动态权限5、权限设置完毕后