php获取网页header信息的方法多种多样,就php语言来说,我知道的方法有4种, 下面逐一献上。

方法一:使用get_headers()函数

推荐指数: ★★★★★

get_header方法最简单只要两行代码即可搞定。如下:

  1. $thisurl = "http://www.lao8.org/";
  2. print_r(get_headers($thisurl, 1));

得到的结果为:

  1. Array
  2. (
  3. [0] => HTTP/1.1 200 OK
  4. [Cache-Control] => max-age=86400
  5. [Content-Length] => 76102
  6. [Content-Type] => text/html
  7. [Content-Location] => http://www.lao8.org/index.html
  8. [Last-Modified] => Fri, 19 Jul 2013 03:52:30 GMT
  9. [Accept-Ranges] => bytes
  10. [ETag] => "50bc48643384ce1:5cb3"
  11. [Server] => Microsoft-IIS/6.0
  12. [X-Powered-By] => ASP.NET
  13. [Date] => Fri, 19 Jul 2013 09:06:39 GMT
  14. [Connection] => close
  15. )

方法二:使用http_response_header

推荐指数: ★★★

http_response_headerf方法也很简单,仅三行:

  1. $thisurl = "http://www.lao8.org";
  2. $html = file_get_contents($thisurl );
  3. print_r($http_response_header);

得到的结果为:

  1. Array
  2. (
  3. [0] => HTTP/1.1 200 OK
  4. [1] => Cache-Control: max-age=86400
  5. [2] => Content-Length: 76102
  6. [3] => Content-Type: text/html
  7. [4] => Content-Location: http://www.lao8.org/index.html
  8. [5] => Last-Modified: Fri, 19 Jul 2013 03:52:30 GMT
  9. [6] => Accept-Ranges: bytes
  10. [7] => ETag: "50bc48643384ce1:5cb3"
  11. [8] => Server: Microsoft-IIS/6.0
  12. [9] => X-Powered-By: ASP.NET
  13. [10] => Date: Fri, 19 Jul 2013 09:06:41 GMT
  14. [11] => Connection: close
  15. )

方法三:使用stream_get_meta_data()函数

推荐指数: ★★★

使用stream_get_meta_data()代码也只需三行:

  1. $thisurl = "http://www.lao8.org/";
  2. $fp = fopen($thisurl, 'r');
  3. print_r(stream_get_meta_data($fp));

得到的结果为:

  1. Array
  2. (
  3. [wrapper_data] => Array
  4. (
  5. [0] => HTTP/1.1 200 OK
  6. [1] => Cache-Control: max-age=86400
  7. [2] => Content-Length: 76102
  8. [3] => Content-Type: text/html
  9. [4] => Content-Location: http://www.lao8.org/index.html
  10. [5] => Last-Modified: Fri, 19 Jul 2013 03:52:30 GMT
  11. [6] => Accept-Ranges: bytes
  12. [7] => ETag: "50bc48643384ce1:5cb3"
  13. [8] => Server: Microsoft-IIS/6.0
  14. [9] => X-Powered-By: ASP.NET
  15. [10] => Date: Fri, 19 Jul 2013 09:06:41 GMT
  16. [11] => Connection: close
  17. )
  18. [wrapper_type] => http
  19. [stream_type] => tcp_socket
  20. [mode] => r+
  21. [unread_bytes] => 1086
  22. [seekable] =>
  23. [uri] => http://www.lao8.org/
  24. [timed_out] =>
  25. [blocked] => 1
  26. [eof] =>
  27. )

第四种方法: 使用php的高级函数 CURL()来获取

推荐指数: ★★★★

上面的三种方法能获取一般的网页header信息,如果想要获取更详细的header信息比如网页是否启用了GZip压缩。这时候可以用php的高级函数curl()来获取。

使用curl获得header可以检测GZip压缩
先贴出代码:

  1. <?php
  2. $szUrl = 'http://www.lao8.org/';
  3. $curl = curl_init();
  4. curl_setopt($curl, CURLOPT_URL, $szUrl);
  5. curl_setopt($curl, CURLOPT_HEADER, 1);  //输出header信息
  6. curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1);  //不显示网页内容
  7. curl_setopt($curl, CURLOPT_ENCODING, ''); //允许执行gzip
  8. $data=curl_exec($curl);
  9. if(!curl_errno($curl))
  10. {
  11. $info = curl_getinfo($curl);
  12. $httpHeaderSize = $info['header_size'];  //header字符串体积
  13. $pHeader = substr($data, 0, $httpHeaderSize); //获得header字符串
  14. $split   = array("rn", "n", "r");  //需要格式化header字符串
  15. $pHeader = str_replace($split, '<br>', $pHeader); //使用<br>换行符格式化输出到网页上
  16. echo $pHeader;
  17. }
  18. ?>

输出结果如下:

  1. HTTP/1.1 200 OK
  2. Cache-Control: max-age=86400
  3. Content-Length: 15189
  4. Content-Type: text/html
  5. Content-Encoding: gzip
  6. Content-Location: http://www.lao8.org/index.html
  7. Last-Modified: Fri, 19 Jul 2013 03:52:28 GMT
  8. Accept-Ranges: bytes
  9. ETag: "0268633384ce1:5cb3"
  10. Vary: Accept-Encoding
  11. Server: Microsoft-IIS/6.0
  12. X-Powered-By: ASP.NET
  13. Date: Fri, 19 Jul 2013 09:27:21 GMT

可以看到使用curl获取到的header信息多了这行:Content-Encoding: gzip,网页启用了GZip压缩。

php获取网页header信息的4种方法的更多相关文章

  1. 用Python获取Linux资源信息的三种方法

    方法一:psutil模块 #!usr/bin/env python # -*- coding: utf-8 -*- import socket import psutil class NodeReso ...

  2. JAVA中获取文件MD5值的四种方法

    JAVA中获取文件MD5值的四种方法其实都很类似,因为核心都是通过JAVA自带的MessageDigest类来实现.获取文件MD5值主要分为三个步骤,第一步获取文件的byte信息,第二步通过Messa ...

  3. 这里给大家介绍一下通过 Wi-Fi 连接“慷慨捐赠”你的身份信息的七种方法.

    这里给大家介绍一下通过 Wi-Fi 连接“慷慨捐赠”你的身份信息的七种方法和反制措施. 本文作者:黑子小盆友 1.利用免费热点 它们似乎无处不在,而且它们的数量会在接下来四年里增加三倍.但是它们当中很 ...

  4. Win7系统与它的Virtualbox中安装的Ubuntu14.04共享信息的几种方法

    虚拟机是每一个程序猿必备的工具.本文依据最新版VirtualBox用户手冊的提示,通过自己的亲自实践,给出了Win7系统与执行在当中的VirtualBox 5.0.2中的Ubuntu 14.04共享信 ...

  5. MYSQL获取自增ID的四种方法

    MYSQL获取自增ID的四种方法 1. select max(id) from tablename 2.SELECT LAST_INSERT_ID() 函数 LAST_INSERT_ID 是与tabl ...

  6. Android获取APK包名的几种方法

    Android获取APK包名的几种方法:1.adb shell pm list package -f | findstr 关键字 #只能获取到包名,主Activity名无法获取到 2.使用aapt-- ...

  7. PHP获取文件后缀名的三种方法

    如下: <? PHP获取文件后缀名的几种方法1: function get_file_type($filename){ $type = substr($filename, strrpos($fi ...

  8. Knockout获取数组元素索引的2种方法,在MVC中实现

    原文:Knockout获取数组元素索引的2种方法,在MVC中实现 在遍历数组.集合的时候,通常要获取元素的索引,本篇体验使用Knockout获取索引的2种方法. 假设有这样的一个模型: namespa ...

  9. [Q]“获取AutoCAD安装信息时失败...”解决方法

    “获取AutoCAD安装信息时失败...”解决方法:在“setup.exe”上右键,以管理员权限运行即可.

随机推荐

  1. Windows Phone中Wallet钱包的使用

    前言 Windows Phone 8中加入了钱包Wallet这个功能,这个功能非常的有意思,开发者可以通过Wallet提供的API创建获取Wallet中的商品.统一管理用户的收集优惠券.信用卡.成员资 ...

  2. iOS学习之Object-C语言内存管理高级

    一.属性的内存管理

  3. Android开发随笔之ScrollView嵌套GridView[ 转]

    今天在开发中用到了需要ScrollView嵌套GridView的情况,由于这两款控件都自带滚动条,当他们碰到一起的时候便会出问题,即GridView会显示不全,为了解决这个问题查了N多资料,某个谷歌的 ...

  4. 实体框架 (EF) 入门 => 一、我该用哪个工作流?

    入门的参考资料:http://msdn.microsoft.com/zh-cn/data/ee712907 本篇的参考资料:http://msdn.microsoft.com/zh-cn/data/j ...

  5. MFC源码不能设置断点调试

    用VS2013中MFC开发应用程序时,进入MFC源码设置断点调试.但是在调试过程中发现无法进入源码.最后发现在MFC设置的MFC的使用默认值是在共享dll中使用MFC,这就意味着MFC中的源码并没有连 ...

  6. Spring事务总结

    事务是什么? 事务就是用来解决类似问题,事务是一系列的动作,它们综合在一起才是一个完整的工作单元,这些动作必须全部完成,如果有一个失败,那么事务就会回滚到最开始的状态,仿佛什么都没有发生过.在企业级应 ...

  7. 揭开NodeJS的神秘面纱!

    一.NodeJS是什么? Node是一个服务器端JavaScript解释器.Node.js是一套用来编写高性能网络服务器的JavaScript包. 二.Node的目标是什么? Node 公开宣称的目标 ...

  8. IIS8中 出现ashx 401:未授权,uploadify上传文件失败

    环境:阿里云服务器 windows2012  + IIS8 +asp.net 访问IIS 出现能正常访问aspx页面,但是通过ajax访问ashx上传文件的时候就出现ashx  Status Code ...

  9. 前端之JavaScript第一天学习(1)-JavaScript 简介

    javaScript 是世界上最流行的编程语言. 这门语言可用于 HTML 和 web,更可广泛用于服务器.PC.笔记本电脑.平板电脑和智能手机等设备. JavaScript 是脚本语言 JavaSc ...

  10. 缓存应用--Memcached分布式缓存简介

    一.   什么是Memcached Memcached 是一个高性能的分布式内存 对象缓存系统,用于动态Web应用以减轻数据库负载.它通过在内存中缓存数据和对象 来减少读取数据库的次数,从而提供动态. ...