php如何只抓取网页头

本文操作环境:windows7系统、PHP7.1版、DELL G3电脑

php如何只抓取网页头?

php获取网页header信息的4种方法

php获取网页header信息的方法多种多样,就php语言来说,我知道的方法有4种, 下面逐一献上。

方法一:使用get_headers()函数

推荐指数: ★★★★★

get_header方法最简单只要两行代码即可搞定。如下:

$thisurl = "Http://www.lao8.org/";
print_r(get_headers($thisurl, 1));

得到的结果为:

Array
(
    [0] => HTTP/1.1 200 OK
    [Cache-Control] => max-age=86400
    [Content-Length] => 76102
    [Content-Type] => text/html
    [Content-Location] => http://www.lao8.org/index.html
    [Last-Modified] => Fri, 19 Jul 2013 03:52:30 GMT
    [Accept-Ranges] => bytes
    [ETag] => "50bc48643384ce1:5cb3"
    [Server] => Microsoft-IIS/6.0
    [X-Powered-By] => asp.net
    [Date] => Fri, 19 Jul 2013 09:06:39 GMT
    [Connection] => close
)

方法二:使用http_response_header

推荐指数: ★★★

http_response_headerf方法也很简单,仅三行:

$thisurl = "http://www.lao8.org";
$html = file_get_contents($thisurl ); 
print_r($http_response_header);

得到的结果为:

Array
(
    [0] => HTTP/1.1 200 OK
    [1] => Cache-Control: max-age=86400
    [2] => Content-Length: 76102
    [3] => Content-Type: text/html
    [4] => Content-Location: http://www.lao8.org/index.html
    [5] => Last-Modified: Fri, 19 Jul 2013 03:52:30 GMT
    [6] => Accept-Ranges: bytes
    [7] => ETag: "50bc48643384ce1:5cb3"
    [8] => Server: Microsoft-IIS/6.0
    [9] => X-Powered-By: ASP.net
    [10] => Date: Fri, 19 Jul 2013 09:06:41 GMT
    [11] => Connection: close
)

方法三:使用stream_get_meta_data()函数

推荐指数: ★★★

使用stream_get_meta_data()代码也只需三行:

$thisurl = "http://www.lao8.org/";
$fp = fopen($thisurl, 'r'); 
print_r(stream_get_meta_data($fp));

得到的结果为:

Array
(
    [wrapper_data] => Array
        (
            [0] => HTTP/1.1 200 OK
            [1] => Cache-Control: max-age=86400
            [2] => Content-Length: 76102
            [3] => Content-Type: text/html
            [4] => Content-Location: http://www.lao8.org/index.html
            [5] => Last-Modified: Fri, 19 Jul 2013 03:52:30 GMT
            [6] => Accept-Ranges: bytes
            [7] => ETag: "50bc48643384ce1:5cb3"
            [8] => Server: Microsoft-IIS/6.0
            [9] => X-Powered-By: ASP.NET
            [10] => Date: Fri, 19 Jul 2013 09:06:41 GMT
            [11] => Connection: close
        )
    [wrapper_type] => http
    [stream_type] => tcp_Socket
    [mode] => r+
    [unread_bytes] => 1086
    [seekable] => 
    [uri] => http://www.lao8.org/
    [timed_out] => 
    [blocked] => 1
    [eof] => 
)

第四种方法: 使用php的高级函数 CURL()来获取

推荐指数: ★★★★

上面的三种方法能获取一般的网页header信息,如果想要获取更详细的header信息比如网页是否启用了GZip压缩。这时候可以用php的高级函数curl()来获取。

使用curl获得header可以检测GZip压缩

先贴出代码:

<?php
$szUrl = 'http://www.lao8.org/';
$curl = curl_init();
curl_setopt($curl, CURLOPT_URL, $szUrl);
curl_setopt($curl, CURLOPT_HEADER, 1);  //输出header信息
curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1);  //不显示网页内容
curl_setopt($curl, CURLOPT_ENcoding, ''); //允许执行gzip
$data=curl_exec($curl); 
if(!curl_errno($curl))
{
    $info = curl_getinfo($curl);
    $httpHeaderSize = $info['header_size'];  //header字符串体积
    $pHeader = substr($data, 0, $httpHeaderSize); //获得header字符串
    $split   = array("rn", "n", "r");  //需要格式化header字符串
    $pHeader = str_replace($split, '<br>', $pHeader); //使用<br>换行符格式化输出到网页上
    echo $pHeader;
}
?>

输出结果如下:

HTTP/1.1 200 OK
Cache-Control: max-age=86400
Content-Length: 15189
Content-Type: text/html
Content-Encoding: gzip
Content-Location: http://www.lao8.org/index.html
Last-Modified: Fri, 19 Jul 2013 03:52:28 GMT
Accept-Ranges: bytes
ETag: "0268633384ce1:5cb3"
Vary: Accept-Encoding
Server: Microsoft-IIS/6.0
X-Powered-By: ASP.NET
Date: Fri, 19 Jul 2013 09:27:21 GMT

可以看到使用curl获取到的header信息多了这行:Content-Encoding: gzip,网页启用了GZip压缩。

--结束END--

本文标题: php如何只抓取网页头

本文链接: https://www.lsjlt.com/news/278.html (转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com    QQ/279061341

猜你喜欢

  • php如何只抓取网页头

    php只抓取网页头的方法:1、使用get_headers()函数;2、使用http_response_header方法;3、使用stream_get_meta_data()函数;4、使用php CURL来获取网页头即可。
    阅读数:335 php
  • PHP网页抓取之抓取百度贴吧邮箱数据代码分享

    百度贴吧大家都经常逛,去逛百度贴吧的时候,经常会看到楼主分享一些资源,要求留下邮箱,楼主才给发。对于一个热门的帖子,留下的邮箱数量是非常多的,楼主需要一个一个的去复制那些回复的邮箱,然后再粘贴发送邮件,不是被折磨死就是被累死。无聊至极写了一
    阅读数:276 贴吧 取之 邮箱
  • PHP的cURL库功能简介 抓取网页、POST数据及其他

    本文介绍了PHP的cURL库的几个使用方法。cURL是一个功能强大的PHP库,可以用于获取网页内容,获取网页内容以及取一个XML文件并把其导入数据库等等。
    阅读数:177 PHP cURL库
  • php curl 怎么只获取数据

    php curl获取数据的方法:1、通过“function http_curl($url, $type = 'get', $data = ''){...}”方法获取数据;2、分别用POST和GET获取数据即可。
    阅读数:218 php curl
  • php怎么设置p3p头

    php设置p3p头的方法:1、编辑HOST,加入“127.0.0.1 www.a.com”;2、创建a_setcookie.php和a_getcookie.php等文件;3、通过header设置p3p头即可。
    阅读数:696 php
  • php怎么只匹配数字和字母

    在PHP中,可以利用正则表达式和“preg_match()”函数来匹配数字和字母,该函数用于执行一个正则表达式的匹配,语法为“preg_match("/^[a-zA-Z0-9]+$/u", 需要匹配的字符串)”。
    阅读数:599 php
  • php的数组只支持数字下标吗

    不是,php数组的下标(索引值)可以是一个字符串,也可以是一个数字。下标为字符串的数组为关联数组,是一种具有特殊索引方式的数组;下标为数字的数组为索引数组,其下标值必须为整数,且从0开始以此类推。
  • php怎么让数组只保留键名

    两种实现方法:1、使用array_keys()函数获取数组全部键名,语法“array_keys(数组)”;如果想要保留指定值的键名,则可设置第二和第三参数,语法“array_keys(数组,指定值,类型是否一致)”。2、利用foreach循环和一个空数组来获取数组全部键名,语法“foreach($arr1 as $k=>$v){$arr2[]=$k;}”。
    阅读数:381 php数组 php
  • php怎么过滤字符串只获取数字

    获取方法:1、使用for语句循环遍历字符串,在循环体中利用is_numeric()函数提取出数字字符并使用“.=”操作符拼接成新字符串。2、利用正则,使用“preg_replace("/[^0-9]/", "", $str)”语句。
    阅读数:226 php 过滤字符串 获取数字
  • php抓取不到数据怎么办

    php抓取不到数据的解决办法:1、在服务器使用“$parm=file_get_contents("php://input");”;2、前端发请求头,代码如“method:'POST',header:{'Content-Type':'application/x-www-form-urlencoded',},”。
    阅读数:170 php
  • 如何用php程序实现网页换肤

    用php程序实现网页换肤的方法:1、准备几张喜欢的皮肤图片;2、创建images目录,将皮肤图片放在images目录下;3、创建skin.php文件,代码如【<?php if(isset($_GET["source"])){$so...】。
    阅读数:350 php 网页
  • php网页为什么会乱码

    php网页乱码的原因:1、网页编码(charset)设置错误,导致浏览器以错误的编码来解析;2、php文件被以错误的编码打开并保存。
    阅读数:529 php乱码
  • 网页怎么隐藏index.php

    网页隐藏index.php的方法:1、找到网站的配置文件;2、添加“rewrite ^/(.*)$ /index.php/$1 last;”内容即可。
    阅读数:318 index.php
  • php网页怎么禁止复制代码

    php网页禁止复制代码的方法:1、登入php虚拟主机;2、进入网站的根目录;3、找到相应模版下的index.php文件;4、通过“document.onselectstart=new Function(...)”代码实现禁止复制即可。
    阅读数:236 php
  • 一个PHP的远程图片抓取函数分享

    远程图片抓取的方法有很多,在本文将为大家介绍下php中是如何实现的,感兴趣的朋友可以了解下
    阅读数:539 PHP函数 远程图片抓取
  • 配置php网页显示各种语法错误

    使用php集成开发环境Appserv网页会提示各种语法错误,但自己配置开发环境无法提示错误,这种情况该怎么解决呢?感兴趣的朋友可以了解下本文
    阅读数:786 配置php 语法错误
  • php网页怎么增加音乐播放器

    php网页增加音乐播放器的方法:1、定义一个磁盘下的mp3文件路径;2、读取文件大小;3、设置文件头的媒体类型;4、读取文件即可。
    阅读数:564 php 音乐播放器
  • php网页的布局是什么意思

    这篇文章主要为大家展示了“php网页的布局是什么意思”,内容简而易懂,条理清晰,希望能够帮助大家解决疑惑,下面让小编带领大家一起研究并学习一下“php网页的布局是什么意思”这篇文章吧。一。 网页的布局方式1.什么是网页的布局方式?网页的布局
    阅读数:739 php
  • php网页内容不显示怎么办

    php网页内容不显示的解决方法:1、打开php.ini配置文件;2、取消error_reporting的注释,将其设置为【error_reporting=E_ALL&~E_NOTICE】;3、重启服务器。
    阅读数:218 php 网页
  • php 怎么把网页转换成图片格式

    php把网页转换成图片格式的方法:1、装chrome-php/chrome;2、安装chromium;3、通过控制器实现转换逻辑即可。
    阅读数:856 php