程序设计十一:多线程获取歌单

2023-10-10 06:50

本文主要是介绍程序设计十一:多线程获取歌单,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

程序设计十一:多线程获取歌单

一、获取歌单ID

使用生产-消费模型,函数producer获取歌单的id,调用requests模块获取分类的页面,使用Beautifulsoup模块提取出歌单id并传入列表

def producer():url_main = 'https://music...'for i in range(0, 1295, 35):url = url_main + str(i)response = requests.get(url=url)html = response.textsoup = BeautifulSoup(html, 'html.parser')# 获取包含歌单详情页网址的标签ids = soup.select('.dec a')# 获取idfor j in range(len(ids)):id = ids[j]['href']q.append(id[13:])

二、获取歌单的详细信息

函数consumer根据生产者传入的id,组合字符串,并调用requests模块获取歌单页面,使用Beautifulsoup模块提取出相关信息。

但该线程运行时,列表还为空时,令该线程sleep0.5秒,等列表中有数据之后再获取处理,代码如下:

def consumer():print('consumer thread start...')# 获取封面图片、歌单标题、创建者id、创建者昵称、介绍、歌曲数量、播放量、添加到播放列表次数、分享次数、评论数while len(q) == 0:time.sleep(0.5)id = q.pop()url = 'https://music...' + idprint(url)response = requests.get(url)html = response.textsoup = BeautifulSoup(html, 'html.parser')# 歌单页面playlist = soup.select('#m-playlist')[0]# 封面图片、歌单标题、创建者id、创建者昵称、介绍、歌曲数量、播放量、添加到播放列表次数、分享次数、评论数img_url = playlist.select('.j-img')[0]['data-src']title = playlist.h2.textuser_id = playlist.select('.name a')[0]['href'][11:]user_name = playlist.select('.name a')[0].textintro = playlist.select('#album-desc-more')[0].textnumber = playlist.select('#playlist-track-count')[0].textplay_count = playlist.select('#play-count')[0].textcollect = playlist.select('.u-btni.u-btni-fav')[0].textshare = playlist.select('.u-btni.u-btni-share')[0].textcomment = playlist.select('.u-btni.u-btni-cmmt')[0].textimg = requests.get(url=img_url)# 存储歌单封面图片if os.path.exists('images') == False:os.mkdir('images')f = open('images/playlist_' + id + ".jpg", "wb")f.write(img.content)f.close()# 存储歌单信息row = [title, user_id, user_name, intro, number, play_count[1:-1], collect[1:-1], share[1:-1], comment[1:-1]]if os.path.exists('song_info.csv') == False:with open('song_info.csv', 'w', encoding='utf-8') as f:writer = csv.writer(f)writer.writerow(['歌单标题', '创建者id', '创建者昵称', '介绍', '歌曲数量', '播放量', '添加到播放列表次数','分享次数', '评论数'])with open('song_info.csv', 'a', encoding='utf-8') as f:writer = csv.writer(f)writer.writerow(row)

三、多线程构建

构建一个生产者线程,37个消费者线程,每当生产者从分类页面获取一个id,就传入列表;消费者线程从列表中取出并获取相关页面的信息,代码如下:

if __name__ == '__main__':c_list = []p = Thread(target=producer)for i in range(37):c = Thread(target=consumer)c_list.append(c)p.start()for c in c_list:c.start()for c in c_list:c.join()print('main end')

四、获取结果

获取的封面图片如下(此处不展示):

生产images文件夹,并按照’playlist_id’的方式组织命名,生成如下文件:

在这里插入图片描述

获取到的信息如下(包括:获取封面图片、歌单标题、创建者id、创建者昵称、介绍、歌曲数量、播放量、添加到播放列表次数、分享次数、评论数):

在这里插入图片描述

使用excel打开该csv文件,更清晰地展示了歌单及相关信息:

在这里插入图片描述

这篇关于程序设计十一:多线程获取歌单的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/178747

相关文章

python获取当前文件和目录路径的方法详解

《python获取当前文件和目录路径的方法详解》:本文主要介绍Python中获取当前文件路径和目录的方法,包括使用__file__关键字、os.path.abspath、os.path.realp... 目录1、获取当前文件路径2、获取当前文件所在目录3、os.path.abspath和os.path.re

Java子线程无法获取Attributes的解决方法(最新推荐)

《Java子线程无法获取Attributes的解决方法(最新推荐)》在Java多线程编程中,子线程无法直接获取主线程设置的Attributes是一个常见问题,本文探讨了这一问题的原因,并提供了两种解决... 目录一、问题原因二、解决方案1. 直接传递数据2. 使用ThreadLocal(适用于线程独立数据)

多线程解析报表

假如有这样一个需求,当我们需要解析一个Excel里多个sheet的数据时,可以考虑使用多线程,每个线程解析一个sheet里的数据,等到所有的sheet都解析完之后,程序需要提示解析完成。 Way1 join import java.time.LocalTime;public class Main {public static void main(String[] args) thro

Android Environment 获取的路径问题

1. 以获取 /System 路径为例 /*** Return root of the "system" partition holding the core Android OS.* Always present and mounted read-only.*/public static @NonNull File getRootDirectory() {return DIR_ANDR

STM32(十一):ADC数模转换器实验

AD单通道: 1.RCC开启GPIO和ADC时钟。配置ADCCLK分频器。 2.配置GPIO,把GPIO配置成模拟输入的模式。 3.配置多路开关,把左面通道接入到右面规则组列表里。 4.配置ADC转换器, 包括AD转换器和AD数据寄存器。单次转换,连续转换;扫描、非扫描;有几个通道,触发源是什么,数据对齐是左对齐还是右对齐。 5.ADC_CMD 开启ADC。 void RCC_AD

Java 多线程概述

多线程技术概述   1.线程与进程 进程:内存中运行的应用程序,每个进程都拥有一个独立的内存空间。线程:是进程中的一个执行路径,共享一个内存空间,线程之间可以自由切换、并发执行,一个进程最少有一个线程,线程实际数是在进程基础之上的进一步划分,一个进程启动之后,进程之中的若干执行路径又可以划分成若干个线程 2.线程的调度 分时调度:所有线程轮流使用CPU的使用权,平均分配时间抢占式调度

Java 多线程的基本方式

Java 多线程的基本方式 基础实现两种方式: 通过实现Callable 接口方式(可得到返回值):

JAVA- 多线程

一,多线程的概念 1.并行与并发 并行:多个任务在同一时刻在cpu 上同时执行并发:多个任务在同一时刻在cpu 上交替执行 2.进程与线程 进程:就是操作系统中正在运行的一个应用程序。所以进程也就是“正在进行的程序”。(Windows系统中,我们可以在任务管理器中看 到进程) 线程:是程序运行的基本执行单元。当操作系统执行一个程序时, 会在系统中建立一个进程,该进程必须至少建立一个线

C语言程序设计(数据类型、运算符与表达式)

一、C的数据类型 C语言提供的数据类型: 二、常量和变量 2.1常量和符号常量 在程序运行过程中,其值不能被改变的量称为常量。 常量区分为不同的类型: 程序中用#define(预处理器指令)命令行定义变量将代表常量,用一个标识符代表一个常量,称为符合常量。 2.2变量 变量代表内存中具有特定属性的一个存储单元,用来存放数据,在程序运行期间,这些值是可以 改变的。 变

JS和jQuery获取节点的兄弟,父级,子级元素

原文转自http://blog.csdn.net/duanshuyong/article/details/7562423 先说一下JS的获取方法,其要比JQUERY的方法麻烦很多,后面以JQUERY的方法作对比。 JS的方法会比JQUERY麻烦很多,主要则是因为FF浏览器,FF浏览器会把你的换行也当最DOM元素。 <div id="test"><div></div><div></div