Python爬取LOL英雄皮肤

Python 爬虫

一实现分析

在官网上找到英雄皮肤的真实链接，查看多个后发现前缀相同，后面对应为英雄的ID和皮肤的ID，皮肤的ID从00开始顺序递增，而英雄ID跟网页中的顺序无关，需要找到英雄ID。
并没有在皮肤页面和英雄页面的元素中找到有关英雄ID的内容，所以想到有可能是通过js文件加载进来的。通过Chrome工具找到跟英雄ID有关的js文件网址。
通过js文件网址获得英雄ID。与图片真实网址进行拼接，得到所有英雄的所有皮肤的图片地址，保存到列表中。
设置图片保存的路径和文件名。
下载。

二知识点与难点

通过re库来正则表达式的处理。
通过json将字符串转成字典类型。
图片地址和文件名称的拼接。
判断图片是否真实存在和下载。

三代码

'''
1. 找到图片路径，获取所有图片真实URL
2. 设置文件名
3. 下载
'''
import requests
import re
import json
def getLOLImages():
# 包含英雄名字和ID的js文件路径
js_url = "http://lol.qq.com/biz/hero/champion.js"
# 获取js文件内容
js_content = requests.get(js_url).text
# 截取需要的内容 .*? 代表所有内容
req = '"keys":(.*?),"data"'
# 取到的是列表，真正想要的是列表中的第一个元素
js_want = re.findall(req, js_content)[0]
# 转成字典形式
js_dict = json.loads(js_want)
# 获取图片的真实URL，并保存到列表中
# http://ossweb-img.qq.com/images/lol/web201310/skin/big266000.jpg
pic_url_list = []
for hero_id in js_dict:
for skin_id in range(20):
skin_id = str(skin_id)
if len(skin_id) == 1:
num_str = '00' + skin_id
elif len(skin_id) == 2:
num_str = '0' + skin_id
pic_url = "http://ossweb-img.qq.com/images/lol/web201310/skin/big" + hero_id + num_str +".jpg"
pic_url_list.append(pic_url)
# 设置文件名称
path = "D://lol/"
path_file_list = []
for pic_name in js_dict.values():
for skin_id in range(20):
skin_id = str(skin_id)
if len(skin_id) == 1:
num_str = '00' + skin_id
elif len(skin_id) == 2:
num_str = '0' + skin_id
path_file = path + pic_name + num_str + ".jpg"
path_file_list.append(path_file)
# 下载
n = 0
for dl_url in pic_url_list:
# n += 1
res = requests.get(dl_url)
if res.status_code == 200:
print("正在下载{}".format(path_file_list[n]))
with open(path_file_list[n], "wb") as f:
f.write(res.content)
n += 1
if __name__ == '__main__':
getLOLImages()

Python爬取LOL英雄皮肤的更多相关文章

Python3爬虫使用requests爬取lol英雄皮肤
本人博客:https://xiaoxiablogs.top 此次爬取lol英雄皮肤一共有两个版本,分别是多线程版本和非多线程版本. 多线程版本 # !/usr/bin/env python # -*- ...
Python爬取 | 王者荣耀英雄皮肤海报
这里只展示代码,具体介绍请点击下方链接. Python爬取 | 王者荣耀英雄皮肤海报 import requests import re import os import time import wi ...
利用python爬取王者荣耀英雄皮肤图片
前两天看到同学用python爬下来LOL的皮肤图片,感觉挺有趣的,我也想试试,于是决定来爬一爬王者荣耀的英雄和皮肤图片. 首先,我们找到王者的官网http://pvp.qq.com/web201605 ...
Python 爬取所有51VOA网站的Learn a words文本及mp3音频
Python 爬取所有51VOA网站的Learn a words文本及mp3音频 #!/usr/bin/env python # -*- coding: utf-8 -*- #Python 爬取所有5 ...
python爬取网站数据
开学前接了一个任务,内容是从网上爬取特定属性的数据.正好之前学了python,练练手. 编码问题因为涉及到中文,所以必然地涉及到了编码的问题,这一次借这个机会算是彻底搞清楚了. 问题要从文字的编码讲 ...
python爬取某个网页的图片-如百度贴吧
python爬取某个网页的图片-如百度贴吧作者:vpoet mail:vpoet_sir@163.com 注:随意copy,不用告诉我 #coding:utf-8 import urllib imp ...
Python:爬取乌云厂商列表，使用BeautifulSoup解析
在SSS论坛看到有人写的Python爬取乌云厂商,想练一下手,就照着重新写了一遍原帖:http://bbs.sssie.com/thread-965-1-1.html #coding:utf- im ...
使用python爬取MedSci上的期刊信息
使用python爬取medsci上的期刊信息,通过设定条件,然后获取相应的期刊的的影响因子排名,期刊名称,英文全称和影响因子.主要过程如下: 首先,通过分析网站http://www.medsci.cn ...
python爬取免费优质IP归属地查询接口
python爬取免费优质IP归属地查询接口具体不表,我今天要做的工作就是: 需要将数据库中大量ip查询出起归属地刚开始感觉好简单啊,毕竟只需要从百度找个免费接口然后来个python脚本跑一晚上就o ...

随机推荐

第一次用FontLad~
FontLad 是一款制作字体的工具使用流程: 1. 下载.安装软件FontLab Studio2. File->New菜单,创建一个工程文件,会自动创建一个ASCII码表对应的字体表3. ...
shared_ptr / weak_ptr 代码片段
参考<<Boost程序库完全开放指南>> shared_ptr 类摘要(只列出了常用的部分)和相关说明 template <class T> class shar ...
MSSQL数据库高版本迁移到低版本
起因是因为客户要把系统从阿里云迁移到本地服务器,阿里云上的数据库版本是MSSQL2016,客户提供的服务器是Server2008R2的,问题就来了,Server2008不支持2016版本,最后只能装的 ...
ceph常用指令
一.集群 1.启动一个ceph 进程启动mon进程 service ceph start mon.node1 启动msd进程 service ceph start mds.node1 启动osd进 ...
Demo—cookie电商购物车
说明:cookie的操作须有域名,简单点说就是需要用发布的方式去访问,查看cookie信息请用开发者模式进入application栏 1.页面布局(结构)(根目录) 商品列表 <!doctype ...
SpringMVC源码解读 - HandlerMapping - AbstractDetectingUrlHandlerMapping系列初始化
AbstractDetectingUrlHandlerMapping是通过扫描方式注册Handler,收到请求时由AbstractUrlHandlerMapping的getHandlerInterna ...
敏捷软件开发：原则、模式与实践——第13章　写给C#程序员的UML概述
第13章写给C#程序员的UML概述 UML包含3类主要的图示.静态图(static diagram)描述了类.对象.数据结构以及它们之间的关系,藉此表现出了软件元素间那些不变的逻辑结构.动态图(dy ...
编写高质量代码改善C#程序的157个建议——建议140：使用默认的访问修饰符
建议140:使用默认的访问修饰符(我不太赞成作者的这个观点,这样减少的代码基本可以忽略不计,但是,如果把访问修饰符补充完整,反而会使代码更加易读.我认为自己写代码时应该尽量加上访问修饰符,看别人写的代 ...
System.Timers.Timer用法
System.Timers.Timer t = new System.Timers.Timer(5000); //设置时间间隔为5秒 private void Form1_Load(object se ...
Java的sun.misc.Unsafe类
阅读目录前言 Unsafe类的作用获取Unsafe对象 Unsafe类中的API 前言以下sun.misc.Unsafe源码和demo基于jdk1.7: 最近在看J.U.C里的源码,很多都用到了 ...

Python爬取LOL英雄皮肤

Python爬取LOL英雄皮肤

一 实现分析

二 知识点与难点

三 代码

Python爬取LOL英雄皮肤的更多相关文章

随机推荐

热门专题

一实现分析

二知识点与难点

三代码