python爬虫常用库和安装 -- windows7环境

1：urllib python自带

2：re python自带

3：requests pip install requests

4：selenium 需要依赖chromedriver

(selenium目前有版本限制：https://blog.csdn.net/qq_36625806/article/details/81463872)

下载地址：https://download.csdn.net/my

安装方式：解压后 python setup.py install -->>添加到环境变量path中

5：chromedriver 下载地址：https://download.csdn.net/download/qq_36625806/10589319

放到python安装目录中即可。

6：phantomjs 无界面浏览器，相当于一个网页控制台

下载地址：https://download.csdn.net/download/qq_36625806/10589328

将bin目录配置到环境变量的path中

7：xlml pip install lxml

或访问：https://pypi.python.org/pypi/lxml 下载

8：beautifulsoup pip install beautifulsoup4 (网页解析库，依赖xlml)

9：pyquery pip install pyquery (网页解析库，语法跟jquery完全一致)

官方api：https://pythonhosted.org/pyquery/api.html

10：pymysql pip install pymysql (操作mysql的库)

11：pymongo pip install pymongo (操作Mongodb数据库)

12：redis pip install redis (操作redis)

13：flask pip install flask (代理)

14：django pip install django (python前端框架)

官网：https://www.djangoproject.com

15：jupyter pip install jupyter (记事本，可以在线运行代码)

安装jupyter如果遇到超时的问题，用以下命令安装：

pip install jupyter --timeout 30000

jupyter安装成功后，在命令行输入：jupyter notebook启动

浏览器会自动打开jupyter

ctrl+回车运行代码

b 换新行

python爬虫常用库和安装 -- windows7环境的更多相关文章

Python爬虫学习==>第五章：爬虫常用库的安装
学习目的: 爬虫有请求库(request.selenium).解析库.存储库(MongoDB.Redis).工具库,此节学习安装常用库的安装正式步骤 Step1:urllib和re库这两个库在安装 ...
爬虫-Python爬虫常用库
一.常用库 1.requests 做请求的时候用到. requests.get("url") 2.selenium 自动化会用到. 3.lxml 4.beautifulsoup 5 ...
Python爬虫常用库安装
建议更换pip源到国内镜像,下载会快很多:https://www.cnblogs.com/believepd/p/10499844.html requests pip3 install request ...
Python 爬虫常用库（九）
python爬虫学习笔记（一）——环境配置（windows系统）
在进行python爬虫学习前,需要进行如下准备工作: python3+pip官方配置 1.Anaconda(推荐,包括python和相关库) [推荐地址:清华镜像] https://mirrors ...
windows下python常用库的安装
windows下python常用库的安装,前提安装了annaconda 的python开发环境.只要已经安装了anaconda,要安装别的库就很简单了.只要使用pip即可,正常安装好python,都会 ...
Python爬虫Urllib库的高级用法
Python爬虫Urllib库的高级用法设置Headers 有些网站不会同意程序直接用上面的方式进行访问,如果识别有问题,那么站点根本不会响应,所以为了完全模拟浏览器的工作,我们需要设置一些Head ...
Python爬虫—requests库get和post方法使用
目录 Python爬虫-requests库get和post方法使用 1. 安装requests库 2.requests.get()方法使用 3.requests.post()方法使用-构造formda ...
python爬虫---selenium库的用法
python爬虫---selenium库的用法 selenium是一个自动化测试工具,支持Firefox,Chrome等众多浏览器在爬虫中的应用主要是用来解决JS渲染的问题. 1.使用前需要安装这个 ...

随机推荐

Git忽略规则(.gitignore配置）不生效原因和解决
问题: .gitignore中已经标明忽略的文件目录下的文件,git push的时候还会出现在push的目录中,或者用git status查看状态,想要忽略的文件还是显示被追踪状态. 原因是因为在gi ...
React中key的讲解
通过阅读React的文档我们知道React这个框架的核心思想是,将页面分割成一个个组件,一个组件还可能嵌套更小的组件,每个组件有自己的数据(属性/状态);当某个组件的数据发生变化时,更新该组件部分的视 ...
11. 无数人难办事? - 迪米特法则(LoD)
11.1 第一天上班时间: 4月2日19点地点: 小菜大鸟住所的客厅任务: 小菜, 大鸟 "回来啦! 怎么样? 第一天上班感受多吧." 大鸟关关心的问道. ...
基于USB接口芯片CH372的人机接口设备设计与实现（转）
摘要: 基于一种新型USB 总线接口芯片CH372,设计出一种人机接口设备-USB 鼠标.阐述了CH372 的工作原理和特点,给出了系统的硬件电路图:在软件设计中,分析了HID 类设备描述符枚举过程 ...
函数节流throttle和防抖debounce
throttle 函数节流不论触发函数多少次,函数只在设定条件到达时调用第一次函数设定,函数节流 1234567891011 let throttle = function(fn,intervalT ...
一起了解 .Net Foundation 项目 No.9
.Net 基金会中包含有很多优秀的项目,今天就和笔者一起了解一下其中的一些优秀作品吧. 中文介绍中文介绍内容翻译自英文介绍,主要采用意译.如与原文存在出入,请以原文为准. DLR/IronPytho ...
git指令-删除
git指令-删除添加一个新文件test.txt到Git并且提交: $ git add test.txt $ git commit -m "add test.txt" [maste ...
Harbor镜像漏洞扫描
Harbor镜像漏洞扫描闲聊:我们知道镜像安全也是容器化建设中一个很重要的环节,像一些商业软件如:Aqua就很专业但是收费也是很昂贵的,今天我们介绍下Harbor自带的镜像扫描器. 一.安装最新版 ...
getUserMedia API及HTML5 调用手机摄像头拍照
getUserMedia API简介 HTML5的getUserMedia API为用户提供访问硬件设备媒体(摄像头.视频.音频.地理位置等)的接口,基于该接口,开发者可以在不依赖任何浏览器插件的条件 ...
Linux学习4-部署LAMP项目
前言 LAMP——linux Apache Mysql PHP 今天我们来学习如何在Linux部署Discuz论坛准备工作 1.一台linux服务器,没有购买服务器的小伙伴也可以使用虚拟机,操 ...

python爬虫常用库和安装 -- windows7环境

python爬虫常用库和安装 -- windows7环境的更多相关文章

随机推荐

热门专题