python 爬去拉钩测试招聘信息

代码如下：

 #coding:utf-8

 import time

 import urllib.request

 from bs4 import BeautifulSoup

 file=open(r'meituancde.txt','w')

 def get_url(i):

     url='https://www.lagou.com/zhaopin/ceshi/%s/?filterOption=%s'%(i,i)

     return url

 def get_html(i):

     headers={

         'User-Agent':'Mozilla/5.0 (Windows NT 6.1) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/56.0.2924.87 Safari/537.36'

         }

     response=urllib.request.Request(url=get_url(i),headers=headers)

     html=urllib.request.urlopen(response).read().decode('utf-8')

     sopu=BeautifulSoup(html)

     return sopu

 def parse(i):

     soup=get_html(i)

     me=soup.findAll('',{'class':'money'}) #工资

     me1=soup.findAll('',{'class':'format-time'})#发布时间

     me2=soup.findAll('',{'class':'li_b_r'})#福利

     me3=soup.findAll('',{'data-lg-tj-id':'8F00'})#公司名字

     meitu={}

     i=0

     for title in me:

         meitu['gongzi'] =me[i].text

         for jianjie in me1:

             meitu['发布时间']=me1[i].text

             for sellum in me2:

                 meitu['福利']=me2[i].text

                 for pire in me3:

                     meitu['公司名称']=me3[i].text

         i+=1

         print(meitu)

         if len(meitu) !=0:

             file.write(str(meitu))

             file.write("\n")

             file.close

 if __name__ == '__main__':

     for i in range(1,31):
         parse(i)

结果图：

python 爬去拉钩测试招聘信息的更多相关文章

用Python爬取智联招聘信息做职业规划
上学期在实验室发表时写了一个爬取智联招牌信息的爬虫. 操作流程大致分为:信息爬取——数据结构化——存入数据库——所需技能等分词统计——数据可视化 1.数据爬取 job = "通信工程师&qu ...
python爬取实习僧招聘信息字体反爬
参考博客:http://www.cnblogs.com/eastonliu/p/9925652.html 实习僧招聘的网站采用了字体反爬,在页面上显示正常,查看源码关键信息乱码,如下图所示: 查看网页 ...
用python抓取智联招聘信息并存入excel
用python抓取智联招聘信息并存入excel tags:python 智联招聘导出excel 引言:前一阵子是人们俗称的金三银四,跳槽的小朋友很多,我觉得每个人都应该给自己做一下规划,根据自己的进步 ...
python爬取智联招聘职位信息（多进程）
测试了下,采用单进程爬取5000条数据大概需要22分钟,速度太慢了点.我们把脚本改进下,采用多进程. 首先获取所有要爬取的URL,在这里不建议使用集合,字典或列表的数据类型来保存这些URL,因为数据量 ...
python之scrapy爬取某集团招聘信息以及招聘详情
1.定义爬取的字段items.py # -*- coding: utf-8 -*- # Define here the models for your scraped items # # See do ...
python爬取智联招聘职位信息（单进程）
我们先通过百度搜索智联招聘,进入智联招聘官网,一看,傻眼了,需要登录才能查看招聘信息没办法,用账号登录进去,登录后的网页如下: 输入职位名称点击搜索,显示如下网页: 把这个URL:https://s ...
python之crawlscrapy爬取某集团招聘信息以及招聘详情
针对这种招聘信息,使用crawlscrapy很适合. 1.settings.py # -*- coding: utf-8 -*- # Scrapy settings for gosuncn proje ...
node.js 89行爬虫爬取智联招聘信息
写在前面的话, .......写个P,直接上效果图.附上源码地址 github/lonhon ok,正文开始,先列出用到的和require的东西: node.js,这个是必须的 request,然发 ...
Python 爬取腾讯招聘职位详情 2019/12/4有效
我爬取的是Python相关职位,先po上代码,(PS:本人小白,这是跟着B站教学视频学习后,老师留的作业,因为腾讯招聘的网站变动比较大,老师的代码已经无法运行,所以po上),一些想法和过程在后面. f ...

随机推荐

continue，break以及加上标签的使用（goto思路）
代码例子在java编程思想70-73页.这里只是想做做总结 java中需要用到标签的唯一理由就是因为由循环嵌套的存在,而且想从多层嵌套循环中break或者continue. 因此,标签只能放在循环前面 ...
sql执行时间过长，请高手指点！
需求:查询出每一位"社工员"通过23门社工课进度100%的数量和23门社工课对应的考试通过的数量. 业务解析: 1.社工员--针对特定学员的一批人.在表USERS_SW_REGIS ...
这一次带你彻底了解Cookie
前言网络早期最大的问题之一是如何管理状态.简而言之,服务器无法知道两个请求是否来自同一个浏览器.当时最简单的方法是在请求时,在页面中插入一些参数,并在下一个请求中传回参数.这需要使用包含参数的隐藏的 ...
Java基础(二)-static关键字分析
static关键字是我们在编程中经常会使用到的,但有些可能只知其然而不知其所以然.下面介绍static关键字的作用再通过例子结合说明. static关键字共有五种作用(先说明static所修饰的不会改 ...
Etcd全套安装教程
一.安装 1.1 二进制安装从这里下载: etcd-v3.2.11-linux-amd64.tar.gz 下载包后解压即可运行: # 解压 tar zxvf etcd-v3.2.11-linux-a ...
Go基础之--数组和切片
数组数组的定义: 数组是具有固定长度并拥有零个或者多个相同数据类型元素的序列定义一个数组的方法:var 变量名[len] type 例子:var a[5] int //3个整数的数组var a[5 ...
Yii2如何添加sql日志记录的配置信息
在使用Yii2框架的时候,常常会出现没有sql日志记录的问题.在代码里一句一句的打印sql语句也不现实.所以就要用文件记录起来. 在 config/web.php 里面的 log配置中增加如下配置 [ ...
while(true)应用之实现自己的消息队列
早些时候,一直有个疑问,就是比如你从前端发一个操作之后,后台为什么能够及时处理你的东西呢?当然了,我说的不是,服务器为什么能够立即接收到你的请求之类高大上的东西.而是,假设你用异步去做一个事情,而后台 ...
MySQL-Select语句高级应用
1.1 SELECT高级应用 1.1.1 前期准备工作本次测试使用的是world数据库,由mysql官方提供下载地址: https://dev.mysql.com/doc/index-other.h ...
db2 update 异常
报错: -错误的sql语句:update Persons SET FirstName = 'Fred' WHERE id_P = 1com.ibm.db2.jcc.am.SqlException: O ...

python 爬去拉钩测试招聘信息

python 爬去拉钩测试招聘信息的更多相关文章

随机推荐

热门专题