程序设计十一:多线程获取歌单

2023-10-10 06:50

本文主要是介绍程序设计十一:多线程获取歌单,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

程序设计十一:多线程获取歌单

一、获取歌单ID

使用生产-消费模型,函数producer获取歌单的id,调用requests模块获取分类的页面,使用Beautifulsoup模块提取出歌单id并传入列表

def producer():url_main = 'https://music...'for i in range(0, 1295, 35):url = url_main + str(i)response = requests.get(url=url)html = response.textsoup = BeautifulSoup(html, 'html.parser')# 获取包含歌单详情页网址的标签ids = soup.select('.dec a')# 获取idfor j in range(len(ids)):id = ids[j]['href']q.append(id[13:])

二、获取歌单的详细信息

函数consumer根据生产者传入的id,组合字符串,并调用requests模块获取歌单页面,使用Beautifulsoup模块提取出相关信息。

但该线程运行时,列表还为空时,令该线程sleep0.5秒,等列表中有数据之后再获取处理,代码如下:

def consumer():print('consumer thread start...')# 获取封面图片、歌单标题、创建者id、创建者昵称、介绍、歌曲数量、播放量、添加到播放列表次数、分享次数、评论数while len(q) == 0:time.sleep(0.5)id = q.pop()url = 'https://music...' + idprint(url)response = requests.get(url)html = response.textsoup = BeautifulSoup(html, 'html.parser')# 歌单页面playlist = soup.select('#m-playlist')[0]# 封面图片、歌单标题、创建者id、创建者昵称、介绍、歌曲数量、播放量、添加到播放列表次数、分享次数、评论数img_url = playlist.select('.j-img')[0]['data-src']title = playlist.h2.textuser_id = playlist.select('.name a')[0]['href'][11:]user_name = playlist.select('.name a')[0].textintro = playlist.select('#album-desc-more')[0].textnumber = playlist.select('#playlist-track-count')[0].textplay_count = playlist.select('#play-count')[0].textcollect = playlist.select('.u-btni.u-btni-fav')[0].textshare = playlist.select('.u-btni.u-btni-share')[0].textcomment = playlist.select('.u-btni.u-btni-cmmt')[0].textimg = requests.get(url=img_url)# 存储歌单封面图片if os.path.exists('images') == False:os.mkdir('images')f = open('images/playlist_' + id + ".jpg", "wb")f.write(img.content)f.close()# 存储歌单信息row = [title, user_id, user_name, intro, number, play_count[1:-1], collect[1:-1], share[1:-1], comment[1:-1]]if os.path.exists('song_info.csv') == False:with open('song_info.csv', 'w', encoding='utf-8') as f:writer = csv.writer(f)writer.writerow(['歌单标题', '创建者id', '创建者昵称', '介绍', '歌曲数量', '播放量', '添加到播放列表次数','分享次数', '评论数'])with open('song_info.csv', 'a', encoding='utf-8') as f:writer = csv.writer(f)writer.writerow(row)

三、多线程构建

构建一个生产者线程,37个消费者线程,每当生产者从分类页面获取一个id,就传入列表;消费者线程从列表中取出并获取相关页面的信息,代码如下:

if __name__ == '__main__':c_list = []p = Thread(target=producer)for i in range(37):c = Thread(target=consumer)c_list.append(c)p.start()for c in c_list:c.start()for c in c_list:c.join()print('main end')

四、获取结果

获取的封面图片如下(此处不展示):

生产images文件夹,并按照’playlist_id’的方式组织命名,生成如下文件:

在这里插入图片描述

获取到的信息如下(包括:获取封面图片、歌单标题、创建者id、创建者昵称、介绍、歌曲数量、播放量、添加到播放列表次数、分享次数、评论数):

在这里插入图片描述

使用excel打开该csv文件,更清晰地展示了歌单及相关信息:

在这里插入图片描述

这篇关于程序设计十一:多线程获取歌单的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/178747

相关文章

Python获取中国节假日数据记录入JSON文件

《Python获取中国节假日数据记录入JSON文件》项目系统内置的日历应用为了提升用户体验,特别设置了在调休日期显示“休”的UI图标功能,那么问题是这些调休数据从哪里来呢?我尝试一种更为智能的方法:P... 目录节假日数据获取存入jsON文件节假日数据读取封装完整代码项目系统内置的日历应用为了提升用户体验,

微信公众号脚本-获取热搜自动新建草稿并发布文章

《微信公众号脚本-获取热搜自动新建草稿并发布文章》本来想写一个自动化发布微信公众号的小绿书的脚本,但是微信公众号官网没有小绿书的接口,那就写一个获取热搜微信普通文章的脚本吧,:本文主要介绍微信公众... 目录介绍思路前期准备环境要求获取接口token获取热搜获取热搜数据下载热搜图片给图片加上标题文字上传图片

使用Python实现获取网页指定内容

《使用Python实现获取网页指定内容》在当今互联网时代,网页数据抓取是一项非常重要的技能,本文将带你从零开始学习如何使用Python获取网页中的指定内容,希望对大家有所帮助... 目录引言1. 网页抓取的基本概念2. python中的网页抓取库3. 安装必要的库4. 发送HTTP请求并获取网页内容5. 解

C++常见容器获取头元素的方法大全

《C++常见容器获取头元素的方法大全》在C++编程中,容器是存储和管理数据集合的重要工具,不同的容器提供了不同的接口来访问和操作其中的元素,获取容器的头元素(即第一个元素)是常见的操作之一,本文将详细... 目录一、std::vector二、std::list三、std::deque四、std::forwa

使用Python高效获取网络数据的操作指南

《使用Python高效获取网络数据的操作指南》网络爬虫是一种自动化程序,用于访问和提取网站上的数据,Python是进行网络爬虫开发的理想语言,拥有丰富的库和工具,使得编写和维护爬虫变得简单高效,本文将... 目录网络爬虫的基本概念常用库介绍安装库Requests和BeautifulSoup爬虫开发发送请求解

Java使用多线程处理未知任务数的方案介绍

《Java使用多线程处理未知任务数的方案介绍》这篇文章主要为大家详细介绍了Java如何使用多线程实现处理未知任务数,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 知道任务个数,你可以定义好线程数规则,生成线程数去跑代码说明:1.虚拟线程池:使用 Executors.newVir

Android App安装列表获取方法(实践方案)

《AndroidApp安装列表获取方法(实践方案)》文章介绍了Android11及以上版本获取应用列表的方案调整,包括权限配置、白名单配置和action配置三种方式,并提供了相应的Java和Kotl... 目录前言实现方案         方案概述一、 androidManifest 三种配置方式

Python如何获取域名的SSL证书信息和到期时间

《Python如何获取域名的SSL证书信息和到期时间》在当今互联网时代,SSL证书的重要性不言而喻,它不仅为用户提供了安全的连接,还能提高网站的搜索引擎排名,那我们怎么才能通过Python获取域名的S... 目录了解SSL证书的基本概念使用python库来抓取SSL证书信息安装必要的库编写获取SSL证书信息

JAVA封装多线程实现的方式及原理

《JAVA封装多线程实现的方式及原理》:本文主要介绍Java中封装多线程的原理和常见方式,通过封装可以简化多线程的使用,提高安全性,并增强代码的可维护性和可扩展性,需要的朋友可以参考下... 目录前言一、封装的目标二、常见的封装方式及原理总结前言在 Java 中,封装多线程的原理主要围绕着将多线程相关的操

Win32下C++实现快速获取硬盘分区信息

《Win32下C++实现快速获取硬盘分区信息》这篇文章主要为大家详细介绍了Win32下C++如何实现快速获取硬盘分区信息,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 实现代码CDiskDriveUtils.h#pragma once #include <wtypesbase