Python爬取歌曲宝音乐:轻松下载Jay的歌

2024-03-23 21:36

本文主要是介绍Python爬取歌曲宝音乐:轻松下载Jay的歌,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

歌曲宝是一个不用付费就能听jay的歌曲,但是每次都只能播放一首不方便,于是今天想把它下载下来,本地循环播放,它所用到的接口是某我的还不错哈

获取搜索接口

分析html请求接口,获取到的数据是直接渲染好的HTML内容,通过curl我们可以得到搜索接口请求构造
在这里插入图片描述

搜索请求:

import requestscookies = {'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710748063,1710768074,1710915841,1710916149','Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710916149',
}headers = {'authority': 'www.gequbao.com','accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.7','accept-language': 'zh-CN,zh;q=0.9','cache-control': 'no-cache',# 'cookie': 'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c=1710748063,1710768074,1710915841,1710916149; Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c=1710916149','pragma': 'no-cache','referer': 'https://www.gequbao.com/','sec-ch-ua': '"Chromium";v="122", "Not(A:Brand";v="24", "Google Chrome";v="122"','sec-ch-ua-mobile': '?0','sec-ch-ua-platform': '"Windows"','sec-fetch-dest': 'document','sec-fetch-mode': 'navigate','sec-fetch-site': 'same-origin','sec-fetch-user': '?1','upgrade-insecure-requests': '1','user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/122.0.0.0 Safari/537.36',
}response = requests.get('https://www.gequbao.com/s/%E5%91%A8%E6%9D%B0%E4%BC%A6', cookies=cookies, headers=headers)
print(response.text)
print(response)

URL解码

由于接口被编码了,很难看出它是如何提交参数的,通过解码,我们可以快速查看接口构造

解码后,如下图:
在这里插入图片描述

用法:替换为想要搜索的歌曲或者是歌手,运行脚本即可

代码替换:

import requestscookies = {'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710748063,1710768074,1710915841,1710916149','Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710916149',
}headers = {'authority': 'www.gequbao.com','accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.7','accept-language': 'zh-CN,zh;q=0.9','cache-control': 'no-cache',# 'cookie': 'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c=1710748063,1710768074,1710915841,1710916149; Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c=1710916149','pragma': 'no-cache','referer': 'https://www.gequbao.com/','sec-ch-ua': '"Chromium";v="122", "Not(A:Brand";v="24", "Google Chrome";v="122"','sec-ch-ua-mobile': '?0','sec-ch-ua-platform': '"Windows"','sec-fetch-dest': 'document','sec-fetch-mode': 'navigate','sec-fetch-site': 'same-origin','sec-fetch-user': '?1','upgrade-insecure-requests': '1','user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/122.0.0.0 Safari/537.36',
}response = requests.get('https://www.gequbao.com/s/周杰伦', cookies=cookies, headers=headers)
print(response.text)

清洗数据

使用Beautiful Soup解析HTML

由于搜索的数据不是接口返回,是HTML渲染的,所以我们需要通过 Python的BS模块进行数据处理

# 使用Beautiful Soup解析HTML
soup = BeautifulSoup(html_data, 'html.parser')# 提取标题
title = soup.title.text
print("标题:", title)# 找到所有的<div>标签,并遍历它们
for div in soup.find_all('div', class_='row'):# 检查是否存在类为'text-success'的<div>标签text_success_div = div.find('div', class_='text-success')if text_success_div:# 提取歌手名artist_name = text_success_div.text.strip()# 检查是否存在<a>标签a_tag = div.find('a')if a_tag:# 提取歌曲名song_name = a_tag.text.strip()# 打印歌曲名和歌手名print("歌曲名:", song_name)print("歌手:", artist_name)print()

通过BS处理的数据可以很清晰的获取到歌曲名歌手以及歌曲的ID,而歌曲的ID是用来获取音乐地址

在这里插入图片描述

拼接下载链接

通过网页抓包分析,我们发现下载的时候需要歌曲ID,所以在进行下载之前要处理好ID的获取,然后进行下载调用

for a_tag in soup.find_all('a', class_='text-primary font-weight-bold'):# 提取 href 属性值href_value = a_tag.get('href')# 提取数字部分music_id = href_value.split('/')[-1]# 提取歌曲名song_name = a_tag.text.strip()# 打印歌曲名和音乐IDprint("歌曲名:", song_name)print("音乐ID:", music_id)print()

解析歌曲id

在这里插入图片描述

下载保存

请求歌曲宝下载接口,进行文件下载

在这里插入图片描述

新建一个download方法,进行ID和歌名的接收,在方法内执行音乐下载接口的请求

def download(id,musicname):cookies = {'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710768074,1710915841,1710916149,1710922373','Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710923549',}headers = {'authority': 'www.gequbao.com','accept': 'application/json, text/javascript, */*; q=0.01','accept-language': 'zh-CN,zh;q=0.9','cache-control': 'no-cache',# 'cookie': 'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c=1710768074,1710915841,1710916149,1710922373; Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c=1710923549','pragma': 'no-cache','referer': 'https://www.gequbao.com/music/112019','sec-ch-ua': '"Chromium";v="122", "Not(A:Brand";v="24", "Google Chrome";v="122"','sec-ch-ua-mobile': '?0','sec-ch-ua-platform': '"Windows"','sec-fetch-dest': 'empty','sec-fetch-mode': 'cors','sec-fetch-site': 'same-origin','user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/122.0.0.0 Safari/537.36','x-requested-with': 'XMLHttpRequest',}params = {'id': id,'json': '1',}response = requests.get('https://www.gequbao.com/api/play_url', params=params, cookies=cookies, headers=headers)print(response.json)music_data=response.json()if music_data['code']==1:url = music_data['data']['url']  # 替换为要下载的文件的URLlocal_filename = musicname+".mp3"  # 保存到本地的文件名,可以根据需要修改# 发送GET请求下载文件response = requests.get(url)# 检查请求是否成功if response.status_code == 200:# 打开文件以二进制写模式保存with open(local_filename, 'wb') as file:# 将文件内容写入本地文件file.write(response.content)print("文件已成功下载并保存到:", local_filename)else:print("下载文件失败:", response.status_code)else:print("下载失败"+music_data['msg'])

运行结束后,保存在根目录,如下图:
在这里插入图片描述

尝试放歌
在这里插入图片描述

关于

在这里插入图片描述

🍋希望你能喜欢我的其他作品
《记一次云之家签到抓包》
《记一次视频抓包m3u8解密过程》
《抓包部分软件时无网络+过代理检测 解决办法 安卓黄鸟httpcanary+vmos》
《Python】记录抓包分析自动领取芝麻HTTP每日免费IP(成品+教程)》
《某课抓包视频 安卓手机:黄鸟+某课app+VirtualXposed虚拟框架》

推荐专栏:

《Python爬虫脚本项目实战》

该专栏往期文章:
《【Python爬虫项目实战一】获取Chatgpt3.5免费接口文末付代码(过Authorization认证)》

🥦如果感觉看完文章还不过瘾,欢迎查看我的其它专栏
🥦作者对python有很大的兴趣,完成过很多独立的项目:例如滇医通等等脚本,但是由于版权的原因下架了,爬虫这一类审核比较严谨,稍有不慎就侵权违规了,所以在保证质量的同时会对文章进行筛选

如果您对爬虫感兴趣请收藏或者订阅该专栏哦《Python爬虫脚本项目实战》,如果你有项目欢迎联系我,我会同步教程到本专栏!

🚀Python爬虫项目实战系列文章!!
⭐⭐欢迎订阅⭐⭐

【Python爬虫项目实战一】获取Chatgpt3.5免费接口文末付代码(过Authorization认证)
【Python爬虫项目实战二】Chatgpt还原验证算法-解密某宝伪知网数据接口

⭐⭐欢迎订阅⭐⭐
在这里插入图片描述

Python爬虫脚本项目实战
在这里插入图片描述

这篇关于Python爬取歌曲宝音乐:轻松下载Jay的歌的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/839585

相关文章

Python基于wxPython和FFmpeg开发一个视频标签工具

《Python基于wxPython和FFmpeg开发一个视频标签工具》在当今数字媒体时代,视频内容的管理和标记变得越来越重要,无论是研究人员需要对实验视频进行时间点标记,还是个人用户希望对家庭视频进行... 目录引言1. 应用概述2. 技术栈分析2.1 核心库和模块2.2 wxpython作为GUI选择的优

macOS无效Launchpad图标轻松删除的4 种实用方法

《macOS无效Launchpad图标轻松删除的4种实用方法》mac中不在appstore上下载的应用经常在删除后它的图标还残留在launchpad中,并且长按图标也不会出现删除符号,下面解决这个问... 在 MACOS 上,Launchpad(也就是「启动台」)是一个便捷的 App 启动工具。但有时候,应

Python如何使用__slots__实现节省内存和性能优化

《Python如何使用__slots__实现节省内存和性能优化》你有想过,一个小小的__slots__能让你的Python类内存消耗直接减半吗,没错,今天咱们要聊的就是这个让人眼前一亮的技巧,感兴趣的... 目录背景:内存吃得满满的类__slots__:你的内存管理小助手举个大概的例子:看看效果如何?1.

Python+PyQt5实现多屏幕协同播放功能

《Python+PyQt5实现多屏幕协同播放功能》在现代会议展示、数字广告、展览展示等场景中,多屏幕协同播放已成为刚需,下面我们就来看看如何利用Python和PyQt5开发一套功能强大的跨屏播控系统吧... 目录一、项目概述:突破传统播放限制二、核心技术解析2.1 多屏管理机制2.2 播放引擎设计2.3 专

Python中随机休眠技术原理与应用详解

《Python中随机休眠技术原理与应用详解》在编程中,让程序暂停执行特定时间是常见需求,当需要引入不确定性时,随机休眠就成为关键技巧,下面我们就来看看Python中随机休眠技术的具体实现与应用吧... 目录引言一、实现原理与基础方法1.1 核心函数解析1.2 基础实现模板1.3 整数版实现二、典型应用场景2

Python实现无痛修改第三方库源码的方法详解

《Python实现无痛修改第三方库源码的方法详解》很多时候,我们下载的第三方库是不会有需求不满足的情况,但也有极少的情况,第三方库没有兼顾到需求,本文将介绍几个修改源码的操作,大家可以根据需求进行选择... 目录需求不符合模拟示例 1. 修改源文件2. 继承修改3. 猴子补丁4. 追踪局部变量需求不符合很

python+opencv处理颜色之将目标颜色转换实例代码

《python+opencv处理颜色之将目标颜色转换实例代码》OpenCV是一个的跨平台计算机视觉库,可以运行在Linux、Windows和MacOS操作系统上,:本文主要介绍python+ope... 目录下面是代码+ 效果 + 解释转HSV: 关于颜色总是要转HSV的掩膜再标注总结 目标:将红色的部分滤

Python 中的异步与同步深度解析(实践记录)

《Python中的异步与同步深度解析(实践记录)》在Python编程世界里,异步和同步的概念是理解程序执行流程和性能优化的关键,这篇文章将带你深入了解它们的差异,以及阻塞和非阻塞的特性,同时通过实际... 目录python中的异步与同步:深度解析与实践异步与同步的定义异步同步阻塞与非阻塞的概念阻塞非阻塞同步

Python Dash框架在数据可视化仪表板中的应用与实践记录

《PythonDash框架在数据可视化仪表板中的应用与实践记录》Python的PlotlyDash库提供了一种简便且强大的方式来构建和展示互动式数据仪表板,本篇文章将深入探讨如何使用Dash设计一... 目录python Dash框架在数据可视化仪表板中的应用与实践1. 什么是Plotly Dash?1.1

在C#中调用Python代码的两种实现方式

《在C#中调用Python代码的两种实现方式》:本文主要介绍在C#中调用Python代码的两种实现方式,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录C#调用python代码的方式1. 使用 Python.NET2. 使用外部进程调用 Python 脚本总结C#调