python3中的urllib.parse的常用方法

将URL按一定的格式进行拆分

使用 urllib.parse.urlparse将url分为6个部分，返回一个包含6个字符串项目的元组：协议、位置、路径、参数、查询、片段

参照官方地址：https://docs.python.org/3/library/urllib.parse.html

import urllib.parse

#urlparse将url分为6个部分

url ="https://i.cnblogs.com/EditPosts.aspx?opt=1"

url1 = "cheme://netloc/path;parameters?query#fragment"

url_change = urllib.parse.urlparse(url)

print(url_change)

输出结果为：

ParseResult(scheme='https', netloc='i.cnblogs.com', path='/EditPosts.aspx', params='', query='opt=1', fragment='')

其中 scheme 是协议 netloc 是域名服务器 path 相对路径 params是参数，query是查询的条件

使用 urllib.parse.urlsplit 将url分为5个部分，返回一个包含字符串项目的元组：协议、位置、路径、查询、片段

 import urllib.parse

 #urlsplit将url分为5个部分

 url ="https://i.cnblogs.com/EditPosts.aspx?opt=1"

 url_change = urllib.parse.urlsplit(url)

 print(url_change)

输出结果为：

ParseResult(scheme='https', netloc='i.cnblogs.com', path='/EditPosts.aspx',query='opt=1', fragment='')

其中 scheme 是协议 netloc 是域名服务器 path 相对路径，query是查询的条件

对URL按照一定的规格进行拼接

使用 urllib.parse.urljoin将相对的一个地址组合成一个url，对于输入没有限制，开头必须是http://或者https://，否则将不组合前面的部分。

 import urllib.parse

 host = "https://127.0.0.1"

 #host ="127.0.0.1"

 port = ""

 new_url = urllib.parse.urljoin(host,port)

 print(new_url)

输出结果为：

　　https://127.0.0.1/8888

如果 host ="127.0.0.1"，则输出的只是： 8888

parse_qs 有几种实现

urllib.parse.parse_qs 返回字典
urllib.parse.parse_qsl 返回列表

import urllib.parse

#urlparse将url分为6个部分

url ="https://i.cnblogs.com/EditPosts.aspx?opt=1"

url_change = urllib.parse.urlparse(url) # 将url拆分为6个部分

query = url_change.query #取出拆分后6个部分中的查询模块query

lst_query = urllib.parse.parse_qsl(query)  #使用parse_qsl返回列表

dict1 =dict(lst_query)  #将返回的列表转换为字典

dict_query =urllib.parse.parse_qs(query)  #使用parse_qs返回字典

print("使用parse_qsl返回列表  ：",lst_query)

print("将返回的列表转换为字典 ：",dict1)

print("使用parse_qs返回字典   : ",dict_query)

# data = "test=test&test2=test2&test2=test3"

# print(urllib.parse.parse_qsl(data)) #返回列表

# print(urllib.parse.parse_qs(data))  #返回字典

python3中的urllib.parse的常用方法的更多相关文章

Python2中的urllib、urllib2和 Python3中的urllib、requests
目录 Python2.x中 urllib和urllib2 常用方法和类 Python3.x中 urllib requests Python2.x中 urllib和urllib2 urllib 和 ur ...
详解：Python2中的urllib、urllib2与Python3中的urllib以及第三方模块requests
在python2中,urllib和urllib2都是接受URL请求的相关模块,但是提供了不同的功能.两个最显著的不同如下: 1.urllib2可以接受一个Request类的实例来设置URL请求的hea ...
Python3中使用urllib的方法详解(header,代理,超时,认证,异常处理)_python
我们可以利用urllib来抓取远程的数据进行保存哦,以下是python3 抓取网页资源的多种方法,有需要的可以参考借鉴. 1.最简单 import urllib.request response = ...
在python3中使用urllib.request编写简单的网络爬虫
转自:http://www.cnblogs.com/ArsenalfanInECNU/p/4780883.html Python官方提供了用于编写网络爬虫的包 urllib.request, 我们主要 ...
Python3中使用urllib的方法详解(header,代理,超时,认证,异常处理)
出自 http://www.jb51.net/article/93125.htm
python3中urllib的基本使用
urllib 在python3中,urllib和urllib2进行了合并,现在只有一个urllib模块,urllib和urllib2的中的内容整合进了urllib.request,urlparse整合 ...
urllib.parse.quote
sklearn实战-乳腺癌细胞数据挖掘(博主亲自录制视频) https://study.163.com/course/introduction.htm?courseId=1005269003& ...
Python 的 urllib.parse 库解析 URL
Python 中的 urllib.parse 模块提供了很多解析和组建 URL 的函数. 解析url urlparse() 函数可以将 URL 解析成 ParseResult 对象.对象中包含了六 ...
Python爬虫之urllib.parse详解
Python爬虫之urllib.parse 转载地址 Python 中的 urllib.parse 模块提供了很多解析和组建 URL 的函数. 解析url 解析url( urlparse() ) ur ...

随机推荐

python: super原理
super() 的入门使用在类的继承中,如果重定义某个方法,该方法会覆盖父类的同名方法,但有时,我们希望能同时实现父类的功能,这时,我们就需要调用父类的方法了,可通过使用 super 来实现,比如: ...
SQL-47 如何获取emp_v和employees有相同的数据？
题目描述存在如下的视图:create view emp_v as select * from employees where emp_no >10005;如何获取emp_v和employees ...
json&pickle序列化和软件开发规范
json和pickle 用于序列化的两个模块 json 用于字符串和python数据类型间进行转换,json只支持列表,字典这样简单的数据类型但是它不支持类,函数这样的数据类型转换 pickle ...
c++结构体的排序
出处:https://blog.csdn.net/weixin_39460667/article/details/82695190 引入头文件 #include<algorithm> 结构 ...
vue 安卓5.1 ios9 兼容性白屏问题
// 针对安卓4.4/ios的兼容 import 'babel-polyfill' import Es6Promise from 'es6-promise' require('es6-promise' ...
webapp 安卓 ios 兼容性问题
1.ios js中时间不兼容YYYY-MM-DD这种格式的时间,只支持YYYY/MM/DD这种格式 // 在safari中new Date('2018-09-02') // Invalid Daten ...
牛客网PAT乙级(Basic Level)真题-数素数 (20)
题目描述令Pi表示第i个素数.现任给两个正整数M <= N <= 10000,请输出PM到PN的所有素数. 输入描述: 输入在一行中给出M和N,其间以空格分隔. 输出描述: 输出从PM到 ...
实验楼高级bash脚本编程指南挑战：简单的热身
传送门:https://www.shiyanlou.com/courses/running# 步骤一新建一个 test.sh 输出 Hello Shiyanlou! 步骤二复制 test.sh 为 ...
Cortex-M3 跳转到指定bin执行
跳转前指定sp和msp: #if defined(__GNUC__) __attribute__(( naked )) static void set_sp(unsigned long addr) { ...
谈一谈Crsf和XSS攻击
crsf 和 XSS CRFS攻击全称是一种利用cookie的漏洞进行的一种跨域请求伪造: 攻击者盗用了你的身份,以你的名义发送恶意请求,对服务器来说这个请求是完全合法的,但是却完成了攻击者所期望的一 ...