Lynx以纯文本的形式下载网页
Lynx是一款基于命令行的web浏览器
[root@test88 ~]# yum install lynx -y
[root@test88 ~]# lynx www.baidu.com
以纯文本的形式下载网页
[root@test88 ~]# lynx -dump www.baidu.com > baidu.txt
[root@test88 ~]# cat baidu.txt
#[1]百度搜索
REFRESH(0 sec): [2]http://www.baidu.com/baidu.html?from=noscript [bd_logo1.png]
[3]到百度首页 ____________________ 百度一下
输入法
* [4]手写
* [5]拼音
*
* [6]关闭 [7]百度首页[8]设置[9]登录
[10]新闻[11]hao123[12]地图[13]视频[14]贴吧[15]学术[16]登录[17]设置[18]更多产品
网页[19]新闻[20]贴吧[21]知道[22]音乐[23]图片[24]视频[25]地图[26]文库[27]更多» 手机百度 [28]把百度设为主页[29]关于百度[30]About Baidu[31]百度推广 ©2017 Baidu [32]使用百度前必读 [33]意见反馈 京ICP证030173号 [34]京公网安备11000002000001号 References # 不仅下载网页同时将网页中所有超链接列在这里 1. http://www.baidu.com/content-search.xml
2. http://www.baidu.com/baidu.html?from=noscript
3. http://www.baidu.com/
4. javascript:;
5. javascript:;
6. javascript:;
7. http://www.baidu.com/
8. javascript:;
9. https://passport.baidu.com/v2/?login&tpl=mn&u=http%3A%2F%2Fwww.baidu.com%2F
10. http://news.baidu.com/
11. http://www.hao123.com/
12. http://map.baidu.com/
13. http://v.baidu.com/
14. http://tieba.baidu.com/
15. http://xueshu.baidu.com/
16. https://passport.baidu.com/v2/?login&tpl=mn&u=http%3A%2F%2Fwww.baidu.com%2F
17. http://www.baidu.com/gaoji/preferences.html
18. http://www.baidu.com/more/
19. http://news.baidu.com/ns?cl=2&rn=20&tn=news&word=
20. http://tieba.baidu.com/f?kw=&fr=wwwt
21. http://zhidao.baidu.com/q?ct=17&pn=0&tn=ikaslist&rn=10&word=&fr=wwwt
22. http://music.baidu.com/search?fr=ps&ie=utf-8&key=
23. http://image.baidu.com/search/index?tn=baiduimage&ps=1&ct=201326592&lm=-1&cl=2&nc=1&ie=utf-8&word=
24. http://v.baidu.com/v?ct=301989888&rn=20&pn=0&db=0&s=25&ie=utf-8&word=
25. http://map.baidu.com/m?word=&fr=ps01000
26. http://wenku.baidu.com/search?word=&lm=0&od=0&ie=utf-8
27. http://www.baidu.com/more/
28. http://www.baidu.com/cache/sethelp/help.html
29. http://home.baidu.com/
30. http://ir.baidu.com/
31. http://e.baidu.com/?refer=888
32. http://www.baidu.com/duty/
33. http://jianyi.baidu.com/
34. http://www.beian.gov.cn/portal/registerSystemInfo?recordcode=11000002000001
Lynx以纯文本的形式下载网页的更多相关文章
- Python下载网页的几种方法
get和post方式总结 get方式:以URL字串本身传递数据参数,在服务器端可以从'QUERY_STRING'这个变量中直接读取,效率较高,但缺乏安全性,也无法来处理复杂的数据(只能是字符串,比如在 ...
- C# 网络编程之webBrowser获取网页url和下载网页中图片
该文章主要是通过C#网络编程的webBrowser获取网页中的url并简单的尝试瞎子啊网页中的图片,主要是为以后网络开发的基础学习.其中主要的通过应用程序结合网页知识.正则表达式实现浏览.获取url. ...
- python-day3爬虫基础之下载网页
今天主要学习了关于网页下载器的一些内容,下边做一下总结: 1.网页下载器,顾名思义,就是将URL所对应的网页以HTML的形式下载到本地,最终存储成本地文件或者还是本地内存字符串,然后进行后续的分析与处 ...
- JavaWeb学习之转发和重定向、会话技术:cookie、session、验证码实例、URLConnection使用(下载网页)(4)
1.转发和重定向 HttpServletResponse response 转发: RequestDispatcher dispatcher = request.getRequestDispatche ...
- windows phone 7,sliverlight 下载网页的解析,关于wp7 gb2312编码
原文:windows phone 7,sliverlight 下载网页的解析,关于wp7 gb2312编码 关于silverlight和wp7(windows phone 7)是默认不支持gb2312 ...
- Java的URL来下载网页源码
import java.io.BufferedInputStream; import java.io.BufferedReader; import java.io.IOException; impor ...
- http下载网页
//http.c #include <stdio.h>#include <stdlib.h>#include <string.h>#include <sys/ ...
- NPOI生成不规则Excel表格(并以流的形式下载,不将文件保存在服务器上,直接在客户端导出excel)
//下载NPOI类库并添加引用 using NPOI.SS.UserModel; using NPOI.HSSF.UserModel; using NPOI.SS.Util; public stati ...
- PHP下载网页
<?php /* author:whq 作用:获取网页的内容 */ include "../Snoopy/Snoopy.class.php";class Cute ...
随机推荐
- 【MVVM Dev】多个具有依赖性质的ComboBox对数据的过滤
一.前言 在界面编程中,我们常常会遇到具有依赖性质的ComboBox框,比如最常见的: 省/直辖市 => 地级市/区 => 区/街道 今天就说一下在WPF的MVVM模式中如何实现该功能 二 ...
- 【BZOJ4802】欧拉函数(Pollard_rho)
[BZOJ4802]欧拉函数(Pollard_rho) 题面 BZOJ 题解 这么大的范围肯定不好杜教筛. 考虑欧拉函数的计算式,显然只需要把\(n\)分解就好了. 直接\(Pollard\_rho\ ...
- bzoj4144【AMPPZ2014】Petrol
题解: 首先注意到起点和终点都是加油站; 假设中途经过某个非加油站的点u,u连到v,离u最近的加油站是x,那么从u到x加油后回到u,再到v一定不比直接从u到v差: 因 ...
- 【BZOJ 4449】[Neerc2015]Distance on Triangulation 多边形分治结构
这题好神啊……正解方向是分治,据我所知的分治方法有:I.离线后直接对多边形以及所有的询问进行分治 II.建立多边形的分治结构(对于三角形来说类似线段树,对于对角线来说类似平衡树),然后每次在这个分治结 ...
- selenium - Select类 - 下拉框
WebDriver提供了Select类来处理下拉框. 如百度搜索设置的下拉框,如下图: from selenium import webdriver from selenium.webdriver.s ...
- 图像处理之直方图均衡化及C源码实现
1 直方图均衡化(Histogram Equalization)简介 图像对比度增强的方法可以分成两类:一类是直接对比度增强方法;另一类是间接对比度增强方法.直方图拉伸和直方图均衡化是两种最常见的间接 ...
- (二)SMO算法
11 SMO优化算法(Sequential minimal optimization) SMO算法由Microsoft Research的John C. Platt在1998年提出,并成为最快的二次规 ...
- 题解【luogu3709 大爷的字符串题】
Description 个人觉得这是这道题最难的一步...出题人的语文... 每次给出一个区间,求这个区间最少能被多少个单调上升的序列覆盖. Solution 这个东西可以转化为这个区间中出现次数最多 ...
- python 删除文件/夹
原文 : http://www.cnblogs.com/SophiaTang/archive/2012/01/16/2323467.html import os 删除文件: os.remove() 删 ...
- 【NOI2017】游戏 2-sat算法
[题目]LibreOJ [题意]n场游戏,有三种车ABC,给定长度为n的字符串,'a'表示不能选A,'b''c'同理,'x'表示不限,至多d个'x'.有m个限制(i,hi,j,hj)表示如果第i场选择 ...