使用python爬虫实现百度翻译功能
python爬虫实现百度翻译： python解释器【模拟浏览器】，发送【post请求】，传入待【翻译的内容】作为参数，获取【百度翻译的结果】

通过开发者工具，获取发送请求的地址

提示：翻译内容发送的请求地址，绝对不是打开百度翻译的那个地址，想要抓取地址，就要借助【浏览器的开发者工具】，或者其他抓包工具

下面介绍获取请求地址的具体方法
以Chrome为例

打开百度翻译：http://fanyi.baidu.com/
【点击右键】>【检查】>【network】（如果是火狐浏览器，点击【网络】）
点击【XHR】项，（有些需要刷新，有些异步的请求不需要刷新）
在页面【输入翻译的词汇】
在XHR项下，查找包含【输入需要翻译的词汇】的请求
查看请求的参数，需要【点击请求】>【Headers】>最下面的【Form Data】
（这里有一个坑：我们会发现有多个sug项，其实是因为百度翻译只要每输入一个字母就会发送一次请求，所以虽然多个请求的地址都是一样的，但是只有最后一个sug项的参数才是最后的词汇）

操作截图 :

请求地址在这里

献上实现的代码

直接上代码，具体步骤下载注释上了

不会配置环境，安装python的包，请参考下一篇：
https://i-beta.cnblogs.com/posts/edit-done;postId=11945465
py05bdfanyi.py文件：https://xpwi.github.io/py/py%E7%88%AC%E8%99%AB/py05bdfanyi.py

 # python爬虫实现百度翻译

 # urllib和request POST参数提交

 # 缺少包请自行查看之前的笔记

 from urllib import request,parse

 import json

 def fanyi(keyword):

     base_url = 'http://fanyi.baidu.com/sug'

     # 构建请求对象

     data = {

         'kw': keyword

     }

     data = parse.urlencode(data)

     # 模拟浏览器

     header = {"User-Agent": "mozilla/4.0 (compatible; MSIE 5.5; Windows NT)"}

     req = request.Request(url=base_url,data=bytes(data,encoding='utf-8'),headers=header)

     res = request.urlopen(req)

     # 获取响应的json字符串

     str_json = res.read().decode('utf-8')

     # 把json转换成字典

     myjson = json.loads(str_json)

     info = myjson['data'][0]['v']

     print(info)

 if __name__=='__main__':

     while True:

         keyword = input('请输入翻译的单词：')

         if keyword == 'q':

             break

         fanyi(keyword)

代码运行

如果还有问题未能得到解决，搜索887934385交流群，进入后下载资料工具安装包等。最后，感谢观看！

Python爬虫教程-实现百度翻译的更多相关文章

Python爬虫爬取百度翻译之数据提取方法json
工具:Python 3.6.5.PyCharm开发工具.Windows 10 操作系统说明:本例为实现输入中文翻译为英文的小程序,适合Python爬虫的初学者一起学习,感兴趣的可以做英文翻译为中文的 ...
python --爬虫--爬取百度翻译
import requestsimport json class baidufanyi: def __init__(self, trans_str): self.lang_detect_url = ' ...
Python爬虫教程-08-post介绍(百度翻译)（下）
Python爬虫教程-08-post介绍(下) 为了更多的设置请求信息,单纯的通过urlopen已经不太能满足需求,此时需要使用request.Request类构造Request 实例 req = ...
Python爬虫教程-07-post介绍(百度翻译)（上）
Python爬虫教程-07-post介绍(百度翻译)(上) 访问网络两种方法 get: 利用参数给服务器传递信息参数为dict,使用parse编码 post :(今天给大家介绍的post) 一般向服 ...
Python爬虫教程-06-爬虫实现百度翻译(requests)
使用python爬虫实现百度翻译(requests) python爬虫上一篇介绍了怎么使用浏览器的[开发者工具]获取请求的[地址.状态.参数]以及使用python爬虫实现百度翻译功能[urllib] ...
Python爬虫教程-16-破解js加密实例（有道在线翻译）
python爬虫教程-16-破解js加密实例(有道在线翻译) 在爬虫爬取网站的时候,经常遇到一些反爬虫技术,比如: 加cookie,身份验证UserAgent 图形验证,还有很难破解的滑动验证 js签 ...
Python爬虫教程-01-爬虫介绍
Spider-01-爬虫介绍 Python 爬虫的知识量不是特别大,但是需要不停和网页打交道,每个网页情况都有所差异,所以对应变能力有些要求爬虫准备工作参考资料精通Python爬虫框架Scrap ...
Python爬虫教程-00-写在前面
鉴于好多人想学Python爬虫,缺没有简单易学的教程,我将在CSDN和大家分享Python爬虫的学习笔记,不定期更新基础要求 Python 基础知识 Python 的基础知识,大家可以去菜鸟教程进行 ...
简单的python爬虫教程：批量爬取图片
python编程语言,可以说是新型语言,也是这两年来发展比较快的一种语言,而且不管是少儿还是成年人都可以学习这个新型编程语言,今天南京小码王python培训机构变为大家分享了一个python爬虫教程. ...

随机推荐

苹果_公司开发者账号_申请DUNS number
申请DUNS number 注意事项:a.公司英文名称,例如:北京京城科技有限公司,Beijing Jingcheng Technology Co., Ltd.(Co.和Ltd.都是缩写,中间用“逗号 ...
Linux中crontab定时任务
crontab安装(centOS) yum -y install vixie-cron crontab语法(计划任务) crontab [-u user] file crontab [-u user] ...
默认值操作符（Freemarker的空值处理）
默认值操作符: 使用形式例如: userName!default_expr 或 userName! 或 (userName)!default_expr 或 (userName)! 这个操作符允许你为可 ...
阿里云ECS服务器部署HADOOP集群（六）：Flume 安装
本篇将在阿里云ECS服务器部署HADOOP集群(一):Hadoop完全分布式集群环境搭建的基础上搭建. 1 环境介绍一台阿里云ECS服务器:master 操作系统:CentOS 7.3 Hadoop ...
Linux系统学习二十二、SAMBA服务—Samba基本使用—share权限访问、客户端的使用
share权限访问配置文件修改 [global]全局设置 workgroup=MYGROUP server string=Samba Server Lamp log file=/var/log/sa ...
CodeForces - 460C（二分+差分）
题意 https://vjudge.net/problem/CodeForces-460C 一个长度为 n 的序列 a ,你有 m 次操作的机会,每次操作是将其中连续的 w 个元素增加 1 .最大化最 ...
信号处理函数陷阱：调用malloc导致死锁[转]
概览因malloc是加锁的,上网了解的相关信息,额外了解到信号处理规范使用,mark 正文在执行malloc的过程中,跳转到了信号处理函数中.而信号处理函数在调用某个系统api时,内部又调用了ma ...
《推送开发全面盘点当前Android后台保活方案的真实运行效果》
登录立即注册 TCP/IP详解资讯动态社区技术精选首页即时通讯网›专项技术区›推送开发全面盘点当前Android后台保活方案的真实运行效果(截止2 ... 帖子打赏分 ...
BZOJ2820/LG2257 YY的GCD 莫比乌斯反演
问题描述 BZOJ2820 LG2257 题解求 \(\sum\limits_{i=1}^{n}{\sum\limits_{j=1}^{m}{[gcd(i,j)==p]}}\) ,其中 \(p\)为 ...
vue使用--vuex快速学习与使用
什么是vuex? Vuex核心概念 Vuex安装与使用 1.安装 2.目录结构与vuex引入 3.store中变量的定义.管理.派生(getter) 4.vuex辅助函数的使用说明 Vuex刷新数据丢 ...