一.python语句存储

1.with open()语句

 with open(name,mode,encoding) as file：

   file.write()

name：包含文件名称的字符串;
mode：决定了打开文件的模式,只读/写入/追加等;
encoding：表示我们要写入数据的编码，一般为 utf-8 或者 gbk ;
file：表示我们在代码中对文件的命名。

2.w：只写模式，如果没有文件则自动创建

 f.write("{} {} {} {}\n".format(title,price,scrible,pic))

3.例子

1）

 with open('a.txt','wb') as f:

     for tag in soup.find_all('div',class_='service-item-pic'):

         a_url = tag.find('a').get('href')

         f.write(a_url)

         f.write('\n')

2）

 for tag in soup.find_all('div',class_='service-item-pic'):

     with open('3.txt', 'a') as f:             

         a_url = tag.find('a').get('href')

         f.write(a_url)

         f.write('\n')

二.保存图片

1.方法

首先用Beautiful Soup结合正则表达式的方式来提取所有链接：

 links = soup.find_all('img', "origin_image zh-lightbox-thumb",src=re.compile(r'.jpg$'))

提取出所有链接后，使用request.urlretrieve来将所有链接保存到本地

2.例子

 import time

 from urllib import request

 from bs4 import BeautifulSoup

 import re

 url = r'https://www.zhihu.com/question/355015346/answer/892031308'

 headers = {'User-Agent':'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/55.0.2883.87 Safari/537.36'}

 page = request.Request(url, headers=headers)

 page_info = request.urlopen(page).read().decode('utf-8')

 soup = BeautifulSoup(page_info, 'html.parser')

 links = soup.find_all('img', "origin_image zh-lightbox-thumb",src=re.compile(r'.jpg$'))

 local_path = r'C:\Users\Administrator\Desktop'

 for link in links:

     print(link.attrs['src'])

     request.urlretrieve(link.attrs['src'], local_path+r'\%s.jpg' % time.time())

python爬虫：将数据保存到本地的更多相关文章

python 爬虫与数据可视化--python基础知识
摘要:偶然机会接触到python语音,感觉语法简单.功能强大,刚好朋友分享了一个网课<python 爬虫与数据可视化>,于是在工作与闲暇时间学习起来,并做如下课程笔记整理,整体大概分为4个 ...
python 爬虫与数据可视化--数据提取与存储
一.爬虫的定义.爬虫的分类(通用爬虫.聚焦爬虫).爬虫应用场景.爬虫工作原理(最后会发一个完整爬虫代码) 二.http.https的介绍.url的形式.请求方法.响应状态码 url的形式: 请求头: ...
pyhton 从web获取json数据保存到本地然后再读取
从web中获取json数据直接进行处理总认为太慢.主要是从web中获取获取数据的过程有点慢. 所以就在想假设先利用空暇时间把json数据获取并保存到本地,然后再从本地文件里读取和操作.应该就要快非常 ...
Python爬虫股票数据爬取
前一篇提到了与股票数据相关的可能几种数据情况,本篇接着上篇,介绍一下多个网页的数据爬取.目标抓取平安银行(000001)从1989年~2017年的全部财务数据. 数据源分析地址分析 http://m ...
Python爬虫与数据图表的实现
要求: 1. 参考教材实例20,编写Python爬虫程序,获取江西省所有高校的大学排名数据记录,并打印输出. 2. 使用numpy和matplotlib等库分析数据,并绘制南昌大学.华东交通大学.江西 ...
在我的新书里，尝试着用股票案例讲述Python爬虫大数据可视化等知识
我的新书,<基于股票大数据分析的Python入门实战>,预计将于2019年底在清华出版社出版. 如果大家对大数据分析有兴趣,又想学习Python,这本书是一本不错的选择.从知识体系上来看, ...
爱奇艺用券付费VIP电影+python爬虫程序+可视化界面+下载本地
申明:本博客中的工具及源码仅供个人学习使用,请勿用作商业等其他任何违法用途!否则后果自负直接步入正题吧! 工具开发环境:windows10,python3.6 工具界面设计:基于python 自带的 ...
从python爬虫以及数据可视化的角度来为大家呈现“227事件”后，肖战粉丝的数据图
前言文的文字及图片来源于网络,仅供学习.交流使用,不具有任何商业用途,版权归原作者所有,如有问题请及时联系我们以作处理. PS:如有需要Python学习资料的小伙伴可以加点击下方链接自行获取t.cn ...
python爬虫之数据的三种解析方式
一.正则解析单字符: . : 除换行以外所有字符 [] :[aoe] [a-w] 匹配集合中任意一个字符 \d :数字 [0-9] \D : 非数字 \w :数字.字母.下划线.中文 \W : 非\ ...

随机推荐

C sharp #002# 结构化编程基础
饮水思源:金老师的自学网站.C# Guide 索引变量与数据类型 C#中For each的写法 C#控制台程序编程技巧简易图片浏览器 BigInteger以及浮点数的比较一.变量与数据类型 us ...
深入理解 Java 数组
Spring Boot 配置文件中的花样，看这一篇足矣！
在快速入门一节中,我们轻松的实现了一个简单的RESTful API应用,体验了一下Spring Boot给我们带来的诸多优点,我们用非常少的代码量就成功的实现了一个Web应用,这是传统的Spring应 ...
查看Oracle被锁的表以及如何解锁
注意权限问题 1.查看是否有被锁的表: select b.owner,b.object_name,a.session_id,a.locked_modefrom v$locked_object a,db ...
django js 实现表格动态标序号
<table class="table table-striped"> <thead> <tr class="key_words_head& ...
ubuntu 中安装jenkins，基于docker运行jenkins
本文是在ubuntu环境下安装jenkins,jenkins运行在docker容器中,至于docker如何安装,本文不再描述,大家可以上网查询下,如何安装docker,下面先放上一个使用jenkin ...
Android 上下文菜单 PopupMenu
@Override protected void onCreate(Bundle savedInstanceState) { super.onCreate(savedInstanceState); s ...
Linux-3.14.12内存管理笔记【伙伴管理算法（3）】
前面分析了伙伴管理算法的初始化,在切入分析代码实现之前,例行先分析一下其实现原理. 伙伴管理算法(也称之为Buddy算法),该算法将所有空闲的页面分组划分为MAX_ORDER个页面块链表进行管理,其中 ...
[PHP] pmap可以查看进程占用内存的详细情况
pmap后面跟进程id,就可以查看进程的详细情况了,例如下面php的进程可以看到php扩展占用内存的情况,方便进行查询问题 00007fb3fa4bf000 44K r-x-- /usr/lib64 ...
自定义v-color指令
在自定义指令的时候,和js行为有关的,最好就写在inserted中去,防止js代码不生效.和样似有关的操作放在bind中去Vue.direactive [d儿 Rai K T V] 没有s哈 < ...

python爬虫：将数据保存到本地

一.python语句存储

1.with open()语句

2.w：只写模式，如果没有文件则自动创建

3.例子

1）

2）

二.保存图片

1.方法

2.例子

python爬虫：将数据保存到本地的更多相关文章

随机推荐

热门专题