程序设计十一:多线程获取歌单

2023-10-10 06:50

本文主要是介绍程序设计十一:多线程获取歌单,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

程序设计十一:多线程获取歌单

一、获取歌单ID

使用生产-消费模型,函数producer获取歌单的id,调用requests模块获取分类的页面,使用Beautifulsoup模块提取出歌单id并传入列表

def producer():url_main = 'https://music...'for i in range(0, 1295, 35):url = url_main + str(i)response = requests.get(url=url)html = response.textsoup = BeautifulSoup(html, 'html.parser')# 获取包含歌单详情页网址的标签ids = soup.select('.dec a')# 获取idfor j in range(len(ids)):id = ids[j]['href']q.append(id[13:])

二、获取歌单的详细信息

函数consumer根据生产者传入的id,组合字符串,并调用requests模块获取歌单页面,使用Beautifulsoup模块提取出相关信息。

但该线程运行时,列表还为空时,令该线程sleep0.5秒,等列表中有数据之后再获取处理,代码如下:

def consumer():print('consumer thread start...')# 获取封面图片、歌单标题、创建者id、创建者昵称、介绍、歌曲数量、播放量、添加到播放列表次数、分享次数、评论数while len(q) == 0:time.sleep(0.5)id = q.pop()url = 'https://music...' + idprint(url)response = requests.get(url)html = response.textsoup = BeautifulSoup(html, 'html.parser')# 歌单页面playlist = soup.select('#m-playlist')[0]# 封面图片、歌单标题、创建者id、创建者昵称、介绍、歌曲数量、播放量、添加到播放列表次数、分享次数、评论数img_url = playlist.select('.j-img')[0]['data-src']title = playlist.h2.textuser_id = playlist.select('.name a')[0]['href'][11:]user_name = playlist.select('.name a')[0].textintro = playlist.select('#album-desc-more')[0].textnumber = playlist.select('#playlist-track-count')[0].textplay_count = playlist.select('#play-count')[0].textcollect = playlist.select('.u-btni.u-btni-fav')[0].textshare = playlist.select('.u-btni.u-btni-share')[0].textcomment = playlist.select('.u-btni.u-btni-cmmt')[0].textimg = requests.get(url=img_url)# 存储歌单封面图片if os.path.exists('images') == False:os.mkdir('images')f = open('images/playlist_' + id + ".jpg", "wb")f.write(img.content)f.close()# 存储歌单信息row = [title, user_id, user_name, intro, number, play_count[1:-1], collect[1:-1], share[1:-1], comment[1:-1]]if os.path.exists('song_info.csv') == False:with open('song_info.csv', 'w', encoding='utf-8') as f:writer = csv.writer(f)writer.writerow(['歌单标题', '创建者id', '创建者昵称', '介绍', '歌曲数量', '播放量', '添加到播放列表次数','分享次数', '评论数'])with open('song_info.csv', 'a', encoding='utf-8') as f:writer = csv.writer(f)writer.writerow(row)

三、多线程构建

构建一个生产者线程,37个消费者线程,每当生产者从分类页面获取一个id,就传入列表;消费者线程从列表中取出并获取相关页面的信息,代码如下:

if __name__ == '__main__':c_list = []p = Thread(target=producer)for i in range(37):c = Thread(target=consumer)c_list.append(c)p.start()for c in c_list:c.start()for c in c_list:c.join()print('main end')

四、获取结果

获取的封面图片如下(此处不展示):

生产images文件夹,并按照’playlist_id’的方式组织命名,生成如下文件:

在这里插入图片描述

获取到的信息如下(包括:获取封面图片、歌单标题、创建者id、创建者昵称、介绍、歌曲数量、播放量、添加到播放列表次数、分享次数、评论数):

在这里插入图片描述

使用excel打开该csv文件,更清晰地展示了歌单及相关信息:

在这里插入图片描述

这篇关于程序设计十一:多线程获取歌单的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/178747

相关文章

SpringBoot服务获取Pod当前IP的两种方案

《SpringBoot服务获取Pod当前IP的两种方案》在Kubernetes集群中,SpringBoot服务获取Pod当前IP的方案主要有两种,通过环境变量注入或通过Java代码动态获取网络接口IP... 目录方案一:通过 Kubernetes Downward API 注入环境变量原理步骤方案二:通过

使用Python实现获取屏幕像素颜色值

《使用Python实现获取屏幕像素颜色值》这篇文章主要为大家详细介绍了如何使用Python实现获取屏幕像素颜色值,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 一、一个小工具,按住F10键,颜色值会跟着显示。完整代码import tkinter as tkimport pyau

python获取cmd环境变量值的实现代码

《python获取cmd环境变量值的实现代码》:本文主要介绍在Python中获取命令行(cmd)环境变量的值,可以使用标准库中的os模块,需要的朋友可以参考下... 前言全局说明在执行py过程中,总要使用到系统环境变量一、说明1.1 环境:Windows 11 家庭版 24H2 26100.4061

使用Python获取JS加载的数据的多种实现方法

《使用Python获取JS加载的数据的多种实现方法》在当今的互联网时代,网页数据的动态加载已经成为一种常见的技术手段,许多现代网站通过JavaScript(JS)动态加载内容,这使得传统的静态网页爬取... 目录引言一、动态 网页与js加载数据的原理二、python爬取JS加载数据的方法(一)分析网络请求1

python多线程并发测试过程

《python多线程并发测试过程》:本文主要介绍python多线程并发测试过程,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、并发与并行?二、同步与异步的概念?三、线程与进程的区别?需求1:多线程执行不同任务需求2:多线程执行相同任务总结一、并发与并行?1、

通过cmd获取网卡速率的代码

《通过cmd获取网卡速率的代码》今天从群里看到通过bat获取网卡速率两段代码,感觉还不错,学习bat的朋友可以参考一下... 1、本机有线网卡支持的最高速度:%v%@echo off & setlocal enabledelayedexpansionecho 代码开始echo 65001编码获取: >

使用Python实现调用API获取图片存储到本地的方法

《使用Python实现调用API获取图片存储到本地的方法》开发一个自动化工具,用于从JSON数据源中提取图像ID,通过调用指定API获取未经压缩的原始图像文件,并确保下载结果与Postman等工具直接... 目录使用python实现调用API获取图片存储到本地1、项目概述2、核心功能3、环境准备4、代码实现

Python多进程、多线程、协程典型示例解析(最新推荐)

《Python多进程、多线程、协程典型示例解析(最新推荐)》:本文主要介绍Python多进程、多线程、协程典型示例解析(最新推荐),本文通过实例代码给大家介绍的非常详细,对大家的学习或工作具有一定... 目录一、multiprocessing(多进程)1. 模块简介2. 案例详解:并行计算平方和3. 实现逻

Python实现获取带合并单元格的表格数据

《Python实现获取带合并单元格的表格数据》由于在日常运维中经常出现一些合并单元格的表格,如果要获取数据比较麻烦,所以本文我们就来聊聊如何使用Python实现获取带合并单元格的表格数据吧... 由于在日常运维中经常出现一些合并单元格的表格,如果要获取数据比较麻烦,现将将封装成类,并通过调用list_exc

通过C#获取Excel单元格的数据类型的方法详解

《通过C#获取Excel单元格的数据类型的方法详解》在处理Excel文件时,了解单元格的数据类型有助于我们正确地解析和处理数据,本文将详细介绍如何使用FreeSpire.XLS来获取Excel单元格的... 目录引言环境配置6种常见数据类型C# 读取单元格数据类型引言在处理 Excel 文件时,了解单元格