Python爬取中国票房网所有电影片名和演员名字，爬取齐鲁网大陆所有电视剧名称

爬取CBO中国票房网所有电影片名和演员名字

# -*- coding: utf-8 -*-

# 爬取CBO中国票房网所有电影片名

import json

import requests

import time

with open("moviename.txt", 'a') as fh:

    for pn in range(1,320):

        url = 'http://www.cbooo.cn/Mdata/getMdata_movie?area=50&type=0&year=0&initial=%E5%85%A8%E9%83%A8&pIndex=' + str(pn)

        print(url)

        time.sleep(2)

        try:

            result = requests.get(url).text

            jresult = json.loads(result)

            movices = jresult.get('pData')

            for movie in movices:

                moviename = movie.get('MovieName')

                print(moviename)

                fh.write(moviename + "\n")

        except:

            print('第'+ str(pn) + '失败！')

# 爬取CBO中国票房网所有演员

import json

import requests

import time

with open("moviestar.txt", 'a') as fh:

    for pn in range(1,2665):

        url = 'http://www.cbooo.cn/Mdata/getMdate_pList?area=50&type=0&year=0&initial=%E5%85%A8%E9%83%A8&pIndex=' + str(pn)

        print(url)

        time.sleep(2)

        try:

            result = requests.get(url).text

            jresult = json.loads(result)

            movices = jresult.get('pData')

            for movie in movices:

                moviename = movie.get('cnName')

                print(moviename)

                fh.write(moviename + "\n")

        except:

            print('第'+ str(pn) + '失败！')

爬取电视剧名称

# -*- coding: utf-8 -*-

# 爬取所有电视剧名称

# 来源：齐鲁电影网

from bs4 import BeautifulSoup

import urllib

url = "http://www.qilumovie.com/filmclass-txt/9.html"

html = urllib.request.urlopen(url).read()

htmldecode = html.decode("gbk") #重点关注

soup = BeautifulSoup(htmldecode,"lxml")

body = soup.body

maplist = body.find_all("li")

with open("tvplay.txt",'a') as fh:

    for tvl in maplist:

        tv = tvl.a.text

        print(tv)

        fh.write(tv + '\n')

如有错误，还请大侠指教一二！

Python爬取中国票房网所有电影片名和演员名字，爬取齐鲁网大陆所有电视剧名称的更多相关文章

python实战项目 — 爬取中国票房网年度电影信息并保存在csv
import pandas as pd import requests from bs4 import BeautifulSoup import time def spider(url, header ...
票房和口碑称霸国庆档，用 Python 爬取猫眼评论区看看电影《我和我的家乡》到底有多牛
今年的国庆档电影市场的表现还是比较强势的,两名主力<我和我的家乡>和<姜子牙>起到了很好的带头作用. <姜子牙>首日破 2 亿,一举刷新由<哪吒之魔童降世&g ...
Python爬取中国天气网
Python爬取中国天气网基于requests库制作的爬虫. 使用方法:打开终端输入 “python3 weather.py 北京(或你所在的城市)" 程序正常运行需要在同文件夹下加入一个 ...
初识python 之爬虫：爬取中国天气网数据
用到模块: 获取网页并解析:import requests,html5lib from bs4 import BeautifulSoup 使用pyecharts的Bar可视化工具"绘制图表& ...
Python爬虫爬取BT之家找电影资源
一.写在前面最近看新闻说圣城家园(SCG)倒了,之前BT天堂倒了,暴风影音也不行了,可以说看个电影越来越费力,国内大厂如企鹅和爱奇艺最近也出现一些幺蛾子,虽然目前版权意识虽然越来越强,但是很多资源在 ...
python爬取中国知网部分论文信息
爬取指定主题的论文,并以相关度排序. #!/usr/bin/python3 # -*- coding: utf-8 -*- import requests import linecache impor ...
python爬取中国大学排名
教程来自:[Python网络爬虫与信息提取].MOOC. 北京理工大学目标:爬取最好大学网前50名大学代码如下: import requests from bs4 import Beautiful ...
Python爬取全球是最大的电影数据库网站IMDb数据
在使用 Python 开发爬虫的过程中,requests 和 BeautifulSoup4(别名bs4) 应用的比较广泛,requests主要用于模拟浏览器的客户端请求,以获取服务器端响应,接收到的响 ...
scrapy实例:爬取中国天气网
1.创建项目在你存放项目的目录下,按shift+鼠标右键打开命令行,输入命令创建项目: PS F:\ScrapyProject> scrapy startproject weather # w ...

随机推荐

linux shell 脚本攻略学习16--wc命令详解，tree命令详解
在文本处理的工作中,统计文件的行数,单词数和字符数非常有用.而对于开发人员本身来说,统计LOC(line of code ,代码行数)是一件重要的工作.linux中有什么命令可以帮助我们做统计呢?没错 ...
[Spring学习笔记 5 ] Spring AOP 详解1
知识点回顾:一.IOC容器---DI依赖注入:setter注入(属性注入)/构造子注入/字段注入(注解 )/接口注入 out Spring IOC容器的使用: A.完全使用XML文件来配置容器所要管理 ...
[Spring学习笔记 4 ] AOP 概念原理以及java动态代理
一.Spring IoC容器补充(1) Spring IoC容器,DI(依赖注入): 注入的方式:设值方法注入setter(属性注入)/构造子注入(构造函数传入依赖的对象)/字段注入Field(注解) ...
iOS 持续集成
iOS 持续集成系列 - 开篇前言 iOS 开发在经过这几年的野蛮生长之后,慢慢地趋于稳定.无论开发语言是 Objective-C 还是 Swift,工程类型是 Hybird 还是原生,开发思想是 ...
C语言学习笔记 (001) - 常量指针与指针常量的区别（转帖）
三个名词虽然非常绕嘴,不过说的非常准确.用中国话的语义分析就可以很方便地把三个概念区分开. 一) 常量指针. 常量是形容词,指针是名词,以指针为中心的一个偏正结构短语.这样看,常量指针本质是指针,常量 ...
Windbg找出memory leak的一种笨办法
以下内容是转自 http://www.cnblogs.com/fbird/p/5889596.html 以前做项目碰到过一个问题,在客户的站点上面发现有严重的内存泄漏.幸运的是我们找到了重现的步骤,一 ...
HDU 2492 Ping pong （数状数组）
Ping pong Time Limit: 2000/1000 MS (Java/Others) Memory Limit: 32768/32768 K (Java/Others)Total S ...
【MySQL】乐观锁和悲观锁
最近学习了一下数据库的悲观锁和乐观锁,根据自己的理解和网上参考资料总结如下: 悲观锁介绍(百科): 悲观锁,正如其名,它指的是对数据被外界(包括本系统当前的其他事务,以及来自外部系统的事务处理)修改持 ...
mybatis自定义插件动态修改sql语句
step1:定义Interceptor实现org.apache.ibatis.plugin.Interceptor import org.apache.commons.logging.Log; imp ...
<welcome-file>index.action</welcome-file>直接设置action，404和struts2中的解决方案
这几天的项目页面的访问全部改为.action访问,在修改首页时遇到了问题.将web.xml文件中<welcome-file>index.action</welcome-file> ...

Python爬取中国票房网所有电影片名和演员名字，爬取齐鲁网大陆所有电视剧名称

Python爬取中国票房网所有电影片名和演员名字，爬取齐鲁网大陆所有电视剧名称的更多相关文章

随机推荐

热门专题