【python爬虫】爬云音乐我和xxx共同听过的歌曲

闲聊的时候，觉得，想写个爬虫，爬下2个人共同听过的歌曲有哪些，然后一鼓作气，花了一个多小时，写了一个。支持最近一周和所有时间，需要用户没有关闭听歌排行显示

How to start

使用到的工具是Selenium一个web自动化测试工具，提供IDE以及插件多种方式。python下安装

pip install selenium

chromedriver.exe 下载对应Chrome版本的driver.exe，仓库带了一份Chrome version 78的driver.exe

代码不多，60行，我就直接贴代码了。

python main.py



# -*- coding:utf-8 -*-

from enum import Enum

from time import sleep

from selenium import webdriver

import selenium.webdriver.support.ui as ui

import sys

reload(sys)

sys.setdefaultencoding('utf8')

def get_song_rank_list(url, songs_time):

	print("\n-------------Start---------------")

	driver = webdriver.Chrome(

		executable_path='./drv/chromedriver')

	# https://sites.google.com/a/chromium.org/chromedriver/downloads chrome对应版本driver

	driver.get(url)

	driver.switch_to.frame('g_iframe')

	wait = ui.WebDriverWait(driver, 15)

	data = ""

	song_dict = {}

	if wait.until(lambda driver: driver.find_element_by_class_name('g-bd')):

		if songs_time == 1:

			driver.find_element_by_id('rHeader').find_element_by_id('songsall').click()

			sleep(3)

		data += driver.find_element_by_id('rHeader').find_element_by_tag_name('h4').text

		print(data)

		lists = driver.find_element_by_class_name('m-record').find_elements_by_tag_name('li')

		print("Top{}:".format(len(lists)))

		for l in lists:

			name = (l.find_element_by_tag_name('b').text).decode("utf-8")

			singer = (l.find_element_by_class_name('s-fc8').text.replace('-', '')).decode("utf-8")

			times = l.find_element_by_class_name('bg').get_attribute('style')

			song = "{}, {}, {}".format(name, singer, times)

			print(song)

			song_dict[name] = song

	return song_dict

def compare_song(dict1, dict2):

	print("\n--------------------------------")

	print("\n---->Same song between us")

	for name, song in dict1.iteritems():

		if name in dict2:

			print(song)

	print("---->End")

	print("\n--------------------------------")

SONGS_WEEK = 0

SONGS_ALL = 1

if __name__ == '__main__':

	girl = get_song_rank_list("https://music.163.com/#/user/songs/rank?id=288007045", SONGS_ALL)

	boy = get_song_rank_list("https://music.163.com/#/user/songs/rank?id=39661960", SONGS_ALL)

	compare_song(girl, boy)

Console

【python爬虫】爬云音乐我和xxx共同听过的歌曲的更多相关文章

Python爬虫 - 爬取百度html代码前200行
Python爬虫 - 爬取百度html代码前200行 - 改进版, 增加了对字符串的.strip()处理源代码如下: # 改进版, 增加了 .strip()方法的使用 # coding=utf-8 ...
用Python爬虫爬取广州大学教务系统的成绩（内网访问）
用Python爬虫爬取广州大学教务系统的成绩(内网访问) 在进行爬取前,首先要了解: 1.什么是CSS选择器? 每一条css样式定义由两部分组成,形式如下: [code] 选择器{样式} [/code ...
使用Python爬虫爬取网络美女图片
代码地址如下:http://www.demodashi.com/demo/13500.html 准备工作安装python3.6 略安装requests库(用于请求静态页面) pip install ...
Python爬虫|爬取喜马拉雅音频
"GOOD Python爬虫|爬取喜马拉雅音频喜马拉雅是知名的专业的音频分享平台,用户规模突破4.8亿,汇集了有声小说,有声读物,儿童睡前故事,相声小品等数亿条音频,成为国内发展最快.规模 ...
python爬虫爬取内容中，-xa0，-u3000的含义
python爬虫爬取内容中,-xa0,-u3000的含义 - CSDN博客 https://blog.csdn.net/aiwuzhi12/article/details/54866310
Python爬虫爬取一篇韩寒新浪博客
网上看到大神对Python爬虫爬到非常多实用的信息,认为非常厉害.突然对想学Python爬虫,尽管自己没学过Python.但在网上找了一些资料看了一下,看到爬取韩寒新浪博客的视频.共三集,第一节讲爬取 ...
Python爬虫爬取全书网小说，程序源码+程序详细分析
Python爬虫爬取全书网小说教程第一步:打开谷歌浏览器,搜索全书网,然后再点击你想下载的小说,进入图一页面后点击F12选择Network,如果没有内容按F5刷新一下点击Network之后出现如下 ...
python爬虫—爬取英文名以及正则表达式的介绍
python爬虫—爬取英文名以及正则表达式的介绍爬取英文名: 一. 爬虫模块详细设计 (1)整体思路对于本次爬取英文名数据的爬虫实现,我的思路是先将A-Z所有英文名的连接爬取出来,保存在一个cs ...
一个简单的python爬虫,爬取知乎
一个简单的python爬虫,爬取知乎主要实现爬取一个收藏夹里所有问题答案下的图片文字信息暂未收录,可自行实现,比图片更简单具体代码里有详细注释,请自行阅读项目源码: # -*- cod ...

随机推荐

docker部署zabbix并设置自动发现规则
docker部署zabbix比源码安装简单一些,特此记录: 机器准备: zabbix-server: 192.168.0.150 homeserver zabbix-agent: 192.168. ...
论文翻译：Conditional Random Fields as Recurrent Neural Networks
Conditional Random Fields as Recurrent Neural Networks ICCV2015 cite237 1摘要: 像素级标注的重要性(语义分割图像理解) ...
JAVA日常之四
构造函数又称“构建器”,函数名称与类名称完全相同,无返回值. 每个类都有构造函数. 可以自定义构造函数,并且可以创建多个重载/过载的构造函数. 若没有手动创建该函数,总会存在一个默认的构造函数(无参 ...
Python解Leetcode： 725. Split Linked List in Parts
题目描述:给定一个单链表,写一个函数把它分成k个单链表.分割成的k个单链表中,两两之间长度差不超过1,允许为空.分成的k个链表中,顺序要和原先的保持一致,比如说每个单链表有3个结点,则第一个单链表的结 ...
HDU1401（双向BFS）
题意:http://acm.hdu.edu.cn/showproblem.php?pid=1401 给你8*8的棋盘和4个棋子初始位置.最终位置,问你能否在8次操作后达到该状态. 思路: 双向BFS, ...
第1章：Python语言与Linux系统管理
1.Python语言为什么流行 1).简单易学 2).丰富强大的库 3).开发效率高 2.Python语言有什么缺点 1).Python的执行速度不够快 2).Python的GIL锁限制并发:GIL是 ...
linux下的终端利器 tmux 安装以及使用
ref :https://www.jianshu.com/p/fd3bbdba9dc9 Introduction 为什么使用tmux? 因为如果我们用terminal连接remote server.发 ...
怎样在Chrome浏览器上安装 Vue Devtools 扩展程序
第一步: 前往 GitHub 下载 Vue Devtools 项目文件 https://github.com/vuejs/vue-devtools 注意: 1. 将分支切换为 master 2. 下载 ...
怎样发出一个HTTP请求
需要使用 xhr.send(); 参数为请求数据体, 如果没有就传入null, 一般来说, GET请求是不用传参的, POST就视情况而定, 理论上所有GET请求都可以改为POST, 反之则不行. v ...
Java Thread(线程)案例详解sleep和wait的区别
上次对Java Thread有了总体的概述与总结,当然大多都是理论上的,这次我将详解Thread中两个常用且容易疑惑的方法.并通过实例代码进行解疑... F区别 sleep()方法 sleep()使当 ...

【python爬虫】 爬云音乐我和xxx共同听过的歌曲

How to start

Console

【python爬虫】 爬云音乐我和xxx共同听过的歌曲的更多相关文章

随机推荐

热门专题

【python爬虫】爬云音乐我和xxx共同听过的歌曲

【python爬虫】爬云音乐我和xxx共同听过的歌曲的更多相关文章