python3爬虫抓取智联招聘职位信息代码

上代码，有问题欢迎留言指出。

# -*- coding: utf-8 -*-

"""

Created on Tue Aug  7 20:41:09 2018

@author: brave-man

blog: http://www.cnblogs.com/zrmw/

"""

import requests

from bs4 import BeautifulSoup

import json

def getDetails(url):

    headers = {'User-Agent': 'Mozilla/5.0 (Windows NT 6.1; WOW64; rv:6.0) Gecko/20100101 Firefox/6.0'}

    res = requests.get(url, headers = headers)

    res.encoding = 'utf-8'

    soup = BeautifulSoup(res.text, 'html.parser')

    soup = json.loads(str(soup))

    try:

        with open('jobDetails.txt', 'w') as f:

            print('创建 {} 文件成功'.format('jobDetails.txt'))

    except:

        print('failure')

    details = {}

    for i in soup['data']['results']:

        jobName = i['jobName']

        salary = i['salary']

        company = i['company']['name']

        companyUrl = i['company']['url']

        positionURL = i['positionURL']

        details = {'jobName': jobName,

                   'salary': salary,

                   'company': company,

                   'companyUrl': companyUrl,

                   'positionURL': positionURL

                   }

#        print(details)

        toFile(details)

def toFile(d):

    dj = json.dumps(d)

    try:

        with open('jobDetails.txt', 'a') as f:

            f.write(dj)

#            print('sucessful')

    except:

        print('Error')

def main():

    url = 'https://fe-api.zhaopin.com/c/i/sou?pageSize=60&cityId=635&workExperience=-1&education=-1&companyType=-1&employmentType=-1&jobWelfareTag=-1&kw=python&kt=3&lastUrlQuery={"jl":"635","kw":"python","kt":"3"}'

    getDetails(url)

if __name__ == "__main__":

    main()

执行完上述代码后，会在代码同目录下创建一个保存职位信息的txt文件，jobDetails.txt。

这只是获取一页招聘信息的代码，后续会添加，如何获取url和所有页的招聘信息的代码。

智联招聘网站还是有一点点小坑的，就是不是所有的招聘职位详情页面都是使用智联的官网格式，点开某个招聘职位之后，链接定向到某公司官网的招聘网站上，后面遇到的时候会具体处理。

python3爬虫抓取智联招聘职位信息代码的更多相关文章

python爬取智联招聘职位信息（单进程）
我们先通过百度搜索智联招聘,进入智联招聘官网,一看,傻眼了,需要登录才能查看招聘信息没办法,用账号登录进去,登录后的网页如下: 输入职位名称点击搜索,显示如下网页: 把这个URL:https://s ...
python爬取智联招聘职位信息（多进程）
测试了下,采用单进程爬取5000条数据大概需要22分钟,速度太慢了点.我们把脚本改进下,采用多进程. 首先获取所有要爬取的URL,在这里不建议使用集合,字典或列表的数据类型来保存这些URL,因为数据量 ...
用python抓取智联招聘信息并存入excel
用python抓取智联招聘信息并存入excel tags:python 智联招聘导出excel 引言:前一阵子是人们俗称的金三银四,跳槽的小朋友很多,我觉得每个人都应该给自己做一下规划,根据自己的进步 ...
node.js 89行爬虫爬取智联招聘信息
写在前面的话, .......写个P,直接上效果图.附上源码地址 github/lonhon ok,正文开始,先列出用到的和require的东西: node.js,这个是必须的 request,然发 ...
python3 requests_html 爬取智联招聘数据（简易版）
PS重点:我回来了-----我回来了-----我回来了 1. 基础需要: python3 基础 html5 CS3 基础 2.库的选择: 原始库 urllib2 (这个库早些年的用过,后来淡忘了) ...
一个抓取智联招聘数据并存入表格的python爬虫
talk is cheap...show you the code..... import requests import lxml,time,os from bs4 import Beautiful ...
（java）Jsoup爬虫学习--获取智联招聘（老网站）的全国java职位信息，爬取10页
Jsoup爬虫学习--获取智联招聘(老网站)的全国java职位信息,爬取10页,输出职位名称*****公司名称*****职位月薪*****工作地点*****发布日期 import java.io.I ...
用生产者消费模型爬取智联招聘python岗位信息
爬取python岗位智联招聘这里爬取北京地区岗位招聘python岗位,并存入EXECEL文件内,代码如下: import json import xlwt import requests from ...
笔趣看小说Python3爬虫抓取
笔趣看小说Python3爬虫抓取获取HTML信息解析HTML信息整合代码获取HTML信息 # -*- coding:UTF-8 -*- import requests if __name__ ...

随机推荐

virualbox 虚拟机管理
虚拟机调换后提示UUID一致,需要重新生成新的虚拟机文件的UUID,使用如下命令: D:\Program Files\Oracle\VirtualBox>VBoxManage internalc ...
Use Generic Replacements of 1.X Framework API Classes 用泛型替换Framework 1.X版本的API类
第一章,第一节用泛型替换Framework 1.X版本的API类. 说起来,我是没接触过Framework 1.X版本的程序,12年毕的业(算算时间也一年多了,依旧一事无成,汗),毕业之后到公司实习 ...
深入理解 Java 动态代理机制
Java 有两种代理方式,一种是静态代理,另一种是动态代理.对于静态代理,其实就是通过依赖注入,对对象进行封装,不让外部知道实现的细节.很多 API 就是通过这种形式来封装的. 代理模式结构图(图片来 ...
解决QTableWidget不显示数据的问题
QTableWidget通常用于数据的展示,通过其表格布局可以让用户更清晰的查看数据,同时也让数据的筛选变得更加直观. 不过,初学者们和粗心大意的人总是会发现明明自己数据已经正常添加,可是程序运行之后 ...
Android Studio RecyclerView用法
首先创建一个布局里面放一个文本 <TextView android:id="@+id/textView" android:layout_width="60dp&q ...
23.QT记事本
描述主要功能有: 新建,打开,保存,另存为,打印, 编辑,撤销,,拖放,xml配置文件读写,字体更改,查找替换菜单栏,工具栏,状态栏的实现如下图所示: 效果如下所示: 源码下载地址: htt ...
Java爬虫框架Jsoup学习记录
Jsoup的作用当你想获得某网页的内容,可以使用此框架做个爬虫程序,爬某图片网站的图片(先获得图片地址,之后再借助其他工具下载图片)或者是小说网站的小说内容我使用Jsoup写出的一款小说下载器,小 ...
python网络编程-udp
目录 1. 创建socket 2. udp网络程序-发送数据 3. udp网络程序-接收数据 4. python3中的编码转换 5. udp端口绑定 1. 创建socket 在 Python 中使用 ...
Gvim 和vim 有什么区别
Gvim 和vim 有什么区别 Gvim是windows的 vim是linux的黑色的命令符 Gvim是单独的窗口下的vim,像notepad一样. vim就是在黑乎乎的cmd窗口下的编辑器.wind ...
JVM-Ubuntu18.04.1下编译OpenJDK8
近期开始学习JVM,看的是周老师的<深入理解Java虚拟机>,打算先自己编译个JDK来提升对JVM的兴趣.本文分三部分来描述编译OpenJDK的过程,分别是编译前准备工作.构建编译环境.进 ...

python3爬虫抓取智联招聘职位信息代码

python3爬虫抓取智联招聘职位信息代码的更多相关文章

随机推荐

热门专题