python_selenium智联搜索

去招聘会工作，奈何网上仅仅提供招聘会的公司名字，没有提供招聘的职位，SO我写了个小代码给别人在智联上面搜索职位，由于时间紧迫，前程的就不写了

#!/usr/bin/python3.4

# -*- coding: utf-8 -*-

from selenium import webdriver

from lxml import etree

import time

# 打开浏览器

def openbrowser(keyword):

    global browser

    # 打开谷歌浏览器

    # Firefox()

    # Chrome()

    # browser = webdriver.Chrome()

    options = webdriver.ChromeOptions()

    prefs = {

        'profile.default_content_setting_values': {

            'images': 2

        }

    }

    options.add_experimental_option('prefs', prefs)

    browser = webdriver.Chrome(chrome_options=options)

    try:

        browser.find_element_by_id("KeyWord_kw2").send_keys(keyword)

        browser.find_element_by_class_name("doSearch").click()

        time.sleep(5)

        htmlcontent = browser.page_source

        browser.quit()

    except:

        url = "http://www.zhaopin.com/"

        browser.get(url)

        # 打开浏览器时间

        # print("等待10秒打开浏览器...")

        # time.sleep(10)

        browser.find_element_by_id("KeyWord_kw2").send_keys(keyword)

        browser.find_element_by_class_name("doSearch").click()

        time.sleep(5)

        htmlcontent = browser.page_source

        browser.quit()

    return htmlcontent

def analyzehtml(html):

    info = []

    page = etree.HTML(html.lower())

    hrefs = page.xpath('//a[@style="font-weight: bold"]/text()')

    for href in hrefs:

        info.append(href)

    return info

if __name__ == "__main__":

    file = open("../txt/company.txt")

    companys = file.readlines()

    for keyword in companys:

        print(keyword.strip())

        html = openbrowser(keyword.strip())

        a = analyzehtml(html)

        a.insert(0, str(keyword.strip()))

        print(a)

        b = "&&".join(a)

        if len(b)==0:

            b = "智联没有找到该公司"

        filewrite = open("../txt/qwe.txt", "a")

        filewrite.write("\n" + str(b))

        filewrite.close()

python_selenium智联搜索的更多相关文章

用python抓取智联招聘信息并存入excel
用python抓取智联招聘信息并存入excel tags:python 智联招聘导出excel 引言:前一阵子是人们俗称的金三银四,跳槽的小朋友很多,我觉得每个人都应该给自己做一下规划,根据自己的进步 ...
python爬虫实战（五）--------智联招聘网
前些天帮同事爬取一些智联招聘网上的关于数据分析的职位信息,他说要做一些数据分析看看,现在已经帮他爬完了.我本来想用Scrapy来爬的,但是不知道为什么爬取的数据和真实搜到的数据不太一样,比如:搜索到的 ...
Python+selenium爬取智联招聘的职位信息
整个爬虫是基于selenium和Python来运行的,运行需要的包 mysql,matplotlib,selenium 需要安装selenium火狐浏览器驱动,百度的搜寻. 整个爬虫是模块化组织的,不 ...
Java实例——基于jsoup的简单爬虫实现（从智联获取工作信息）
这几天在学习Java解析xml,突然想到Dom能不能解析html,结果试了半天行不通,然后就去查了一些资料,发现很多人都在用Jsoup解析html文件,然后研究了一下,写了一个简单的实例,感觉还有很多 ...
python爬取智联招聘职位信息（单进程）
我们先通过百度搜索智联招聘,进入智联招聘官网,一看,傻眼了,需要登录才能查看招聘信息没办法,用账号登录进去,登录后的网页如下: 输入职位名称点击搜索,显示如下网页: 把这个URL:https://s ...
异构智联Wi-Fi+蓝牙模组，连接快、准、稳！
下班回家打开门,电灯.电视.空调.音响.电动窗帘.扫地机器人--一呼百应,有序开工,原本冰冷的房子立刻变成了温暖港湾.可以说,舒适便捷的智能设备已经完全融入了我们的生活中. 从单一场景.单一设备,到现 ...
智联招聘卓聘IM演进过程
1. 卓聘IM开发背景智联卓聘是智联旗下高端人才招聘平台,成立快4年了,业务增涨每年以100%速度增涨,业务增涨快在开发和上线速度要求也比较高. 2016年6月提出IM开发需求,7月初上线,开发人 ...
智联卓聘卓聘IM(聊聊)开发实践
1. 卓聘IM开发背景智联卓聘是智联旗下高端人才招聘平台,成立快4年多,业务增涨每年以100%速度增涨快,同时对产品和研发速度都比较高. 2015年提出IM开发,主要用于后选人与猎头及时交流,降低 ...
node.js 89行爬虫爬取智联招聘信息
写在前面的话, .......写个P,直接上效果图.附上源码地址 github/lonhon ok,正文开始,先列出用到的和require的东西: node.js,这个是必须的 request,然发 ...

随机推荐

Android数据库 — — —查询数据
package com.example.datebasetest; import android.content.ContentValues;import android.database.Curso ...
.net core学习笔记（3）-依赖注入
.net core 中使用了大量的依赖注入,对依赖注入一直是一知半解,总想不透,项目中用的是一个网上的开源框架,从底层到web层都是用的构造函数依赖注入. 然后了在继承ActionFilterAttr ...
jenkins配置
自动化测试机器172,27.14.22 IP 一.jenkins要先登录——>点击JCF_Automation——>点击左边配置二.环境变量赋值就不会把进程杀掉
2016 - 1 - 25 CSS初步 (二)
1.The customising link We can change the link's style when we move our pointer on the link like that ...
【转】C#线程同步示例
using System; using System.Threading; // 银行帐户类 class Account { int balance; ...
HTTP简介
HTTP协议是Hyper Text Transfer Protocol(超文本传输协议)的缩写,是用于从万维网(WWW:World Wide Web )服务器传输超文本到本地浏览器的传送协议.. HT ...
Map循环的三种方法
import java.util.HashMap; import java.util.Iterator; import java.util.Map; public class MapTest { pu ...
分享一些DICOM数据下载网站
医院的DICOM数据轻易不让拷出来,所以这里列出一些医学数据,但不局限于DICOM数据网址,供大家下载. 斯坦福大学体数据库(RAW DATA) http://graphics.stanford.ed ...
数据存储之Cookie和Web Storage。
Cookie Cookie,有时也用其复数形式Cookies,指某些网站为了辨别用户身份.进行session跟踪而储存在用户本地终端上的数据(通常经过加密).接下来就谈谈cookie的一些利弊,coo ...
手动搭建Vue环境
Vue+webpack+babel环境搭建 github地址 https://github.com/haoyongliang/webpack-babel-Vue 1.首先要了解Vue项目结构简单的目 ...

python_selenium智联搜索

python_selenium智联搜索

python_selenium智联搜索的更多相关文章

随机推荐

热门专题