鉴客 C# 抓取页面（带认证）

1. [代码][C#]代码

`01`	`HttpWebRequest req = (HttpWebRequest)HttpWebRequest.Create("");`

`02`	`req.UserAgent =` `"Mozilla/4.0 (compatible; MSIE 6.0; Windows NT 5.1; .NET CLR 1.0.3705;)";`

`03`	`req.Method =` `"POST";`

`04`	`req.Accept =` `"text/html,application/xhtml+xml,application/xml;q=0.9,/;q=0.8";`

`05`	`req.Headers.Add("Accept-Language: en-us,en;q=0.5");`

`06`	`req.Headers.Add("Accept-Encoding: gzip,deflate");`

`07`	`req.Headers.Add("Accept-Charset: ISO-8859-1,utf-8;q=0.7,*;q=0.7");`

`08`	`req.KeepAlive =` `true;`

`09`	`req.Headers.Add("Keep-Alive: 300");`

`10`	`req.Referer =` `"copy from url";`

11

`12`	`req.ContentType =` `"application/x-www-form-urlencoded";`

13

`14`	`String Username = copy from url;`

`15`	`String PassWord = copy from url;`

16

`17`	`StreamWriter sw =` `new` `StreamWriter(req.GetRequestStream());`

`18`	`sw.Write(string.Format("&loginname={0}&password={1}&btnSubmit=Log In&institutioncode=H4V9KLUT45AV&version=2", Username, PassWord));`

`19`	`sw.Close();`

`20`	`HttpWebResponse response = (HttpWebResponse)req.GetResponse();`

21

`22`	`StreamReader reader =` `new` `StreamReader(response.GetResponseStream());`

`23`	`string` `tmp = reader.ReadToEnd();`

2. [代码]Cookie 处理跳至 [1] [2] [全屏预览]

view source print ?

`01`	`CookieCollection cookiesResponse =` `new` `CookieCollection();`

02

`03`	`if` `(response !=` `null)`

04 {

`05`	`foreach` `(string` `cookie` `in` `response.Headers["Set-Cookie"].Split(';'))`

06 {

`07`	`string` `name = cookie.Split('=')[0];`

`08`	`string` `value = cookie.Substring(name.Length + 1);`

`09`	`cookiesResponse.Add(new` `Cookie(name.Trim(), value.Trim(), path, domain));`

10 }

11 }

鉴客 C# 抓取页面（带认证）的更多相关文章

爬虫抓取页面数据原理（php爬虫框架有很多）
爬虫抓取页面数据原理(php爬虫框架有很多 ) 一.总结 1.php爬虫框架有很多,包括很多傻瓜式的软件 2.照以前写过java爬虫的例子来看,真的非常简单,就是一个获取网页数据的类或者方法(这里的话 ...
用PHP抓取页面并分析
在做抓取前,记得把php.ini中的max_execution_time设置的大点,不然会报错的.
使用PHP的正则抓取页面中的网址
最近有一个任务,从页面中抓取页面中所有的链接,当然使用PHP正则表达式是最方便的办法.要写出正则表达式,就要先总结出模式,那么页面中的链接会有几种形式呢? 链接也就是超级链接,是从一个元素(文字. ...
CasperJS基于PhantomJS抓取页面
CasperJS基于PhantomJS抓取页面 Casperjs是基于Phantomjs的,而Phantom JS是一个服务器端的 JavaScript API 的 WebKit. CasperJS是 ...
2019-1-29-jekyll-如何加密博客-防止抓取
title author date CreateTime categories jekyll 如何加密博客防止抓取 lindexi 2019-01-29 16:26:17 +0800 2018-2- ...
php抓取页面的几种方式
在做一些天气预报或者RSS订阅的程序时,往往需要抓取非本地文件,一般情况下都是利用php模拟浏览器的访问,通过http请求访问url地址, 然后得到html源代码或者xml数据,得到数据我们不能直接 ...
Python抓取页面中超链接(URL)的三中方法比较(HTMLParser、pyquery、正则表达式) <转>
Python抓取页面中超链接(URL)的3中方法比较(HTMLParser.pyquery.正则表达式) HTMLParser版: #!/usr/bin/python # -*- coding: UT ...
php抓取页面的几种方法详解
本篇文章是对php抓取页面的几种方法进行了详细的分析介绍,需要的朋友参考下在做一些天气预报或者RSS订阅的程序时,往往需要抓取非本地文件,一般情况下都是利用php模拟浏览器的访问,通过http请求 ...
HtmlAgilityPack 抓取页面的乱码处理
HtmlAgilityPack 抓取页面的乱码处理用来解析 HTML 确实方便.不过直接读取网页时会出现乱码. 实际上,它是能正确读到有关字符集的信息,怎么会在输出时,没有取到正确内容. 因此,读两 ...

随机推荐

android 实践项目
电子词典 http://files.cnblogs.com/blogLYF/lyf_danci.apk
js中call方法的使用介绍
js call call 方法请参阅应用于:Function 对象要求版本 5.5 调用一个对象的一个方法,以另一个对象替换当前对象. call([thisObj[,arg1[, arg2[, ...
web app 基础界面框架搭建
一.问题的产生基础框架界面如图1所示,目前app流行布局图1 布局关注点: 1.Title和Footer部分为固定布局position:fixed,存在的争议是android2.x和IOS4一下说 ...
java编码问题
工作中经常遇到java编码问题,由于缺乏研究,总是无法给出确切的答案,这个周末在网上查了一些资料,在此做些汇总. 问题一:在java中读取文件时应该采用什么编码? Java读取文件的方式总体可以分为两 ...
Java1.5泛型指南中文版(Java1.5 Generic Tutorial)
Java1.5泛型指南中文版(Java1.5 Generic Tutorial) 英文版pdf下载链接:http://java.sun.com/j2se/1.5/pdf/generics-tutori ...
nodejs全局安装与本地安装区别
本地安装 1. 将安装包放在 ./node_modules 下(运行 npm 命令时所在的目录),如果没有 node_modules 目录,会在当前执行 npm 命令的目录下生成 node_modul ...
利用文本编辑器输入课堂上练习的Hello.java，并在JDK环境下编译和运行。
Windows下的 Axel下载工具 - 移植自Linux
Axel 是 CLI (command-line interface) 下的一个多线程下载工具,通常我都用它取代 wget 下载各类文件,适用于 Linux 及 BSD 等 UNIX 类平台. 以下是 ...
GCC: compilation process..
gcc -Iproj/src myfile.c -o myfile gcc -c myfile.c "compile without linking gcc -D DEBUG myfile. ...
asm: Writing Inline Assembly
A usual IA includes these parts: asm [volatile] ( AssemblerTemplate : OutputOperands [ : InputOperan ...

鉴客 C# 抓取页面（带认证）

1. [代码][C#]代码

2. [代码]Cookie 处理 跳至 [1] [2] [全屏预览]

鉴客 C# 抓取页面（带认证）的更多相关文章

随机推荐

热门专题

2. [代码]Cookie 处理跳至 [1] [2] [全屏预览]