Python爬取歌曲宝音乐:轻松下载Jay的歌

歌曲宝是一个不用付费就能听jay的歌曲,但是每次都只能播放一首不方便,于是今天想把它下载下来,本地循环播放,它所用到的接口是某我的还不错哈

获取搜索接口

分析html请求接口,获取到的数据是直接渲染好的HTML内容,通过curl我们可以得到搜索接口请求构造
在这里插入图片描述

搜索请求:

import requestscookies = {'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710748063,1710768074,1710915841,1710916149','Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710916149',
}headers = {'authority': 'www.gequbao.com','accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.7','accept-language': 'zh-CN,zh;q=0.9','cache-control': 'no-cache',# 'cookie': 'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c=1710748063,1710768074,1710915841,1710916149; Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c=1710916149','pragma': 'no-cache','referer': 'https://www.gequbao.com/','sec-ch-ua': '"Chromium";v="122", "Not(A:Brand";v="24", "Google Chrome";v="122"','sec-ch-ua-mobile': '?0','sec-ch-ua-platform': '"Windows"','sec-fetch-dest': 'document','sec-fetch-mode': 'navigate','sec-fetch-site': 'same-origin','sec-fetch-user': '?1','upgrade-insecure-requests': '1','user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/122.0.0.0 Safari/537.36',
}response = requests.get('https://www.gequbao.com/s/%E5%91%A8%E6%9D%B0%E4%BC%A6', cookies=cookies, headers=headers)
print(response.text)
print(response)

URL解码

由于接口被编码了,很难看出它是如何提交参数的,通过解码,我们可以快速查看接口构造

解码后,如下图:
在这里插入图片描述

用法:替换为想要搜索的歌曲或者是歌手,运行脚本即可

代码替换:

import requestscookies = {'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710748063,1710768074,1710915841,1710916149','Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710916149',
}headers = {'authority': 'www.gequbao.com','accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.7','accept-language': 'zh-CN,zh;q=0.9','cache-control': 'no-cache',# 'cookie': 'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c=1710748063,1710768074,1710915841,1710916149; Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c=1710916149','pragma': 'no-cache','referer': 'https://www.gequbao.com/','sec-ch-ua': '"Chromium";v="122", "Not(A:Brand";v="24", "Google Chrome";v="122"','sec-ch-ua-mobile': '?0','sec-ch-ua-platform': '"Windows"','sec-fetch-dest': 'document','sec-fetch-mode': 'navigate','sec-fetch-site': 'same-origin','sec-fetch-user': '?1','upgrade-insecure-requests': '1','user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/122.0.0.0 Safari/537.36',
}response = requests.get('https://www.gequbao.com/s/周杰伦', cookies=cookies, headers=headers)
print(response.text)

清洗数据

使用Beautiful Soup解析HTML

由于搜索的数据不是接口返回,是HTML渲染的,所以我们需要通过 Python的BS模块进行数据处理

# 使用Beautiful Soup解析HTML
soup = BeautifulSoup(html_data, 'html.parser')# 提取标题
title = soup.title.text
print("标题:", title)# 找到所有的<div>标签,并遍历它们
for div in soup.find_all('div', class_='row'):# 检查是否存在类为'text-success'的<div>标签text_success_div = div.find('div', class_='text-success')if text_success_div:# 提取歌手名artist_name = text_success_div.text.strip()# 检查是否存在<a>标签a_tag = div.find('a')if a_tag:# 提取歌曲名song_name = a_tag.text.strip()# 打印歌曲名和歌手名print("歌曲名:", song_name)print("歌手:", artist_name)print()

通过BS处理的数据可以很清晰的获取到歌曲名歌手以及歌曲的ID,而歌曲的ID是用来获取音乐地址

在这里插入图片描述

拼接下载链接

通过网页抓包分析,我们发现下载的时候需要歌曲ID,所以在进行下载之前要处理好ID的获取,然后进行下载调用

for a_tag in soup.find_all('a', class_='text-primary font-weight-bold'):# 提取 href 属性值href_value = a_tag.get('href')# 提取数字部分music_id = href_value.split('/')[-1]# 提取歌曲名song_name = a_tag.text.strip()# 打印歌曲名和音乐IDprint("歌曲名:", song_name)print("音乐ID:", music_id)print()

解析歌曲id

在这里插入图片描述

下载保存

请求歌曲宝下载接口,进行文件下载

在这里插入图片描述

新建一个download方法,进行ID和歌名的接收,在方法内执行音乐下载接口的请求

def download(id,musicname):cookies = {'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710768074,1710915841,1710916149,1710922373','Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c': '1710923549',}headers = {'authority': 'www.gequbao.com','accept': 'application/json, text/javascript, */*; q=0.01','accept-language': 'zh-CN,zh;q=0.9','cache-control': 'no-cache',# 'cookie': 'Hm_lvt_c2b69091f94cb4368f25c28fc7c2d28c=1710768074,1710915841,1710916149,1710922373; Hm_lpvt_c2b69091f94cb4368f25c28fc7c2d28c=1710923549','pragma': 'no-cache','referer': 'https://www.gequbao.com/music/112019','sec-ch-ua': '"Chromium";v="122", "Not(A:Brand";v="24", "Google Chrome";v="122"','sec-ch-ua-mobile': '?0','sec-ch-ua-platform': '"Windows"','sec-fetch-dest': 'empty','sec-fetch-mode': 'cors','sec-fetch-site': 'same-origin','user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/122.0.0.0 Safari/537.36','x-requested-with': 'XMLHttpRequest',}params = {'id': id,'json': '1',}response = requests.get('https://www.gequbao.com/api/play_url', params=params, cookies=cookies, headers=headers)print(response.json)music_data=response.json()if music_data['code']==1:url = music_data['data']['url']  # 替换为要下载的文件的URLlocal_filename = musicname+".mp3"  # 保存到本地的文件名,可以根据需要修改# 发送GET请求下载文件response = requests.get(url)# 检查请求是否成功if response.status_code == 200:# 打开文件以二进制写模式保存with open(local_filename, 'wb') as file:# 将文件内容写入本地文件file.write(response.content)print("文件已成功下载并保存到:", local_filename)else:print("下载文件失败:", response.status_code)else:print("下载失败"+music_data['msg'])

运行结束后,保存在根目录,如下图:
在这里插入图片描述

尝试放歌
在这里插入图片描述

关于

在这里插入图片描述

🍋希望你能喜欢我的其他作品
《记一次云之家签到抓包》
《记一次视频抓包m3u8解密过程》
《抓包部分软件时无网络+过代理检测 解决办法 安卓黄鸟httpcanary+vmos》
《Python】记录抓包分析自动领取芝麻HTTP每日免费IP(成品+教程)》
《某课抓包视频 安卓手机:黄鸟+某课app+VirtualXposed虚拟框架》

推荐专栏:

《Python爬虫脚本项目实战》

该专栏往期文章:
《【Python爬虫项目实战一】获取Chatgpt3.5免费接口文末付代码(过Authorization认证)》

🥦如果感觉看完文章还不过瘾,欢迎查看我的其它专栏
🥦作者对python有很大的兴趣,完成过很多独立的项目:例如滇医通等等脚本,但是由于版权的原因下架了,爬虫这一类审核比较严谨,稍有不慎就侵权违规了,所以在保证质量的同时会对文章进行筛选

如果您对爬虫感兴趣请收藏或者订阅该专栏哦《Python爬虫脚本项目实战》,如果你有项目欢迎联系我,我会同步教程到本专栏!

🚀Python爬虫项目实战系列文章!!
⭐⭐欢迎订阅⭐⭐

【Python爬虫项目实战一】获取Chatgpt3.5免费接口文末付代码(过Authorization认证)
【Python爬虫项目实战二】Chatgpt还原验证算法-解密某宝伪知网数据接口

⭐⭐欢迎订阅⭐⭐
在这里插入图片描述

Python爬虫脚本项目实战
在这里插入图片描述

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.hqwc.cn/news/562585.html

如若内容造成侵权/违法违规/事实不符,请联系编程知识网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

浅谈Javascript虚拟列表(virtaul list)改造成虚拟表格(virtaul table)的技术

前端加载百万条数据列表&#xff0c;如果采用真实的DOM插入100万个div&#xff08;或li&#xff09;标签&#xff0c;肯定是非常卡顿的。这就不得不使用虚拟列表技术方案&#xff0c;但是虚拟列表技术方案网上有很详细的实现方法&#xff0c;今天我就来谈谈根据网上的方案&…

【Python音视频技术】玩AI视频创作引发写Python音视频技术系列文章1---视频添加字幕

最近对视频创作感兴趣&#xff0c; 详情见之前写的几篇文章。 【AI应用】模仿爆款视频二次创作短视频操作步骤 【人工智能】AI数字人视频演示 【人工智能】AI视频二次创作演示 作为程序员出身的我&#xff0c;看到一些功能, 我都有猎奇的习惯&#xff0c; 想着自己用什么技…

cryptohack代码(2)

5.XOR 简单异或&#xff0c;简单代码 from pwn import * print(xor(label,13)) 与" "效果一样 6.XOR Properties 题目&#xff1a; 题目给了相应的中字符串 k1k2 ^ k1k2 ^ k3flag ^ k1 ^ k2 ^ k3分别记为A、B、C、D&#xff0c;则flag D ^ A ^ C 异或高级…

每日一题 --- 977. 有序数组的平方[力扣][Go]

今天这一题和昨天的知识点是一样的&#xff0c;就是双指针法。 题目&#xff1a; 给你一个按 非递减顺序 排序的整数数组 nums&#xff0c;返回 每个数字的平方 组成的新数组&#xff0c;要求也按 非递减顺序 排序。 示例 1&#xff1a; 输入&#xff1a;nums [-4,-1,0,3,1…

C++一维数组练习 洛谷

1.冰雹猜想 #include<bits/stdc.h> using namespace std; int main() {int n,a[1002]{0},i1;//i是记个数用的cin>>n;while(n!1)//重点{a[i]n;i;if(n%20) n/2;else n3*n1;}a[i]1;//开始准备输出for(int ji;j>1;j--){cout<<a[j]<< ;}return 0; } #in…

后端Jwt实现Token编码、解码以及axios的request请求头的Token传输方式

目录 一、什么是JWT&#xff1a; 二、Jwt的使用&#xff1a; 第一步&#xff1a;引入依赖&#xff1a; 第二步&#xff1a;配置拦截器&#xff1a;JwtInterceptor.java&#xff1a; 其中异常文件ServiceException配置如下&#xff1a; 全局异常文件GlobalException.java文…

OceanMind海睿思入选中国信通院《2023高质量数字化转型技术解决方案集》

近日&#xff0c;由中国信息通信研究院“铸基计划”编制的《2023高质量数字化转型技术解决方案集&#xff08;第一版&#xff09;》正式发布。 中新赛克海睿思 凭借卓越的产品力以及广泛的行业实践&#xff0c;成功入选该方案集的数据分析行业技术解决方案。 为促进数字化转型…

大模型学习笔记七:LLM应用

文章目录 一、维护生产级别的LLM应用,需要做的事二、符合需求的LLM App维护平台三、LangFuse1)替换OpenAI客户端(把跟OpenAI交互记录到LangFuse)1.1)几个基本概念2)通过LangChain的回调函数触发记录(上面用的原生OpenAI接口,下面是调用LangChain的接口)3)构建一个实际…

蓝桥刷题--N皇后和最近公共祖先

1.N皇后 #include<iostream> using namespace std;const int N 12; int vis[N][N], n, ans;void dfs(int dep) {// 在这个搜索中dep表示行&#xff0c;i表示列// 1 搜索出口if(dep n 1){ans;return;}// 2 继续搜索for(int i 1; i < n; i){// 2.1 排除非法情况if(v…

副业赚钱秘籍:让空闲时间更有价值

副业&#xff0c;无疑是增加收入、实现财务自由的理想途径&#xff0c;尤其适合那些希望利用闲暇时间创造价值的人群。今天&#xff0c;我为您精选了六种副业赚钱策略&#xff0c;让您轻松拓宽财源。 一、网络营销&#xff1a;通过社交媒体、博客或在线市场&#xff0c;巧妙推…

Linux进程管理:(九)实时调度

文章说明&#xff1a; Linux内核版本&#xff1a;5.0 架构&#xff1a;ARM64 参考资料及图片来源&#xff1a;《奔跑吧Linux内核》 Linux 5.0内核源码注释仓库地址&#xff1a; zhangzihengya/LinuxSourceCode_v5.0_study (github.com) 实时指的是一个特定任务的执行时间必…

分布式商业模式是企业提升新质生产力、重塑生产关系的关键(附分布式商业模式设计六要素)

本文内容摘自思二勋所著的《分布式商业生态战略》一书。 如今&#xff0c;数字化转型如火如荼&#xff0c;数字化给予很多企业和个人网络化、生态化、协同化发展机会。一种基于网络的分布式商业模式或将为企业高效率、低成本开展工作提供新的路径。 数字化技术的成熟带来了万…