php如何只抓取网页头

php 2019-01-18 19:01:43 353人浏览无得

摘要

本文操作环境：windows7系统、PHP7.1版、DELL G3电脑php如何只抓取网页头？php获取网页header信息的4种方法php获取网页header信息的方法多种多样，就php语言来说，我知道的方法有4种, 下面逐一献上。方法一

本文操作环境：windows7系统、PHP7.1版、DELL G3电脑

php如何只抓取网页头？

php获取网页header信息的4种方法

php获取网页header信息的方法多种多样，就php语言来说，我知道的方法有4种, 下面逐一献上。

方法一：使用get_headers()函数

推荐指数: ★★★★★

get_header方法最简单只要两行代码即可搞定。如下：

$thisurl = "Http://www.lao8.org/";
print_r(get_headers($thisurl, 1));

得到的结果为：

Array
(
    [0] => HTTP/1.1 200 OK
    [Cache-Control] => max-age=86400
    [Content-Length] => 76102
    [Content-Type] => text/html
    [Content-Location] => http://www.lao8.org/index.html
    [Last-Modified] => Fri, 19 Jul 2013 03:52:30 GMT
    [Accept-Ranges] => bytes
    [ETag] => "50bc48643384ce1:5cb3"
    [Server] => Microsoft-IIS/6.0
    [X-Powered-By] => asp.net
    [Date] => Fri, 19 Jul 2013 09:06:39 GMT
    [Connection] => close
)

方法二：使用http_response_header

推荐指数: ★★★

http_response_headerf方法也很简单，仅三行：

$thisurl = "http://www.lao8.org";
$html = file_get_contents($thisurl ); 
print_r($http_response_header);

得到的结果为：

Array
(
    [0] => HTTP/1.1 200 OK
    [1] => Cache-Control: max-age=86400
    [2] => Content-Length: 76102
    [3] => Content-Type: text/html
    [4] => Content-Location: http://www.lao8.org/index.html
    [5] => Last-Modified: Fri, 19 Jul 2013 03:52:30 GMT
    [6] => Accept-Ranges: bytes
    [7] => ETag: "50bc48643384ce1:5cb3"
    [8] => Server: Microsoft-IIS/6.0
    [9] => X-Powered-By: ASP.net
    [10] => Date: Fri, 19 Jul 2013 09:06:41 GMT
    [11] => Connection: close
)

方法三：使用stream_get_meta_data()函数

推荐指数: ★★★

使用stream_get_meta_data()代码也只需三行：

$thisurl = "http://www.lao8.org/";
$fp = fopen($thisurl, 'r'); 
print_r(stream_get_meta_data($fp));

得到的结果为：

Array
(
    [wrapper_data] => Array
        (
            [0] => HTTP/1.1 200 OK
            [1] => Cache-Control: max-age=86400
            [2] => Content-Length: 76102
            [3] => Content-Type: text/html
            [4] => Content-Location: http://www.lao8.org/index.html
            [5] => Last-Modified: Fri, 19 Jul 2013 03:52:30 GMT
            [6] => Accept-Ranges: bytes
            [7] => ETag: "50bc48643384ce1:5cb3"
            [8] => Server: Microsoft-IIS/6.0
            [9] => X-Powered-By: ASP.NET
            [10] => Date: Fri, 19 Jul 2013 09:06:41 GMT
            [11] => Connection: close
        )
    [wrapper_type] => http
    [stream_type] => tcp_Socket
    [mode] => r+
    [unread_bytes] => 1086
    [seekable] => 
    [uri] => http://www.lao8.org/
    [timed_out] => 
    [blocked] => 1
    [eof] => 
)

第四种方法: 使用php的高级函数 CURL()来获取

推荐指数: ★★★★

上面的三种方法能获取一般的网页header信息，如果想要获取更详细的header信息比如网页是否启用了GZip压缩。这时候可以用php的高级函数curl()来获取。

使用curl获得header可以检测GZip压缩

先贴出代码：

<?php
$szUrl = 'http://www.lao8.org/';
$curl = curl_init();
curl_setopt($curl, CURLOPT_URL, $szUrl);
curl_setopt($curl, CURLOPT_HEADER, 1);  //输出header信息
curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1);  //不显示网页内容
curl_setopt($curl, CURLOPT_ENcoding, ''); //允许执行gzip
$data=curl_exec($curl); 
if(!curl_errno($curl))
{
    $info = curl_getinfo($curl);
    $httpHeaderSize = $info['header_size'];  //header字符串体积
    $pHeader = substr($data, 0, $httpHeaderSize); //获得header字符串
    $split   = array("rn", "n", "r");  //需要格式化header字符串
    $pHeader = str_replace($split, '<br>', $pHeader); //使用<br>换行符格式化输出到网页上
    echo $pHeader;
}
?>

输出结果如下：

HTTP/1.1 200 OK
Cache-Control: max-age=86400
Content-Length: 15189
Content-Type: text/html
Content-Encoding: gzip
Content-Location: http://www.lao8.org/index.html
Last-Modified: Fri, 19 Jul 2013 03:52:28 GMT
Accept-Ranges: bytes
ETag: "0268633384ce1:5cb3"
Vary: Accept-Encoding
Server: Microsoft-IIS/6.0
X-Powered-By: ASP.NET
Date: Fri, 19 Jul 2013 09:27:21 GMT

可以看到使用curl获取到的header信息多了这行：Content-Encoding: gzip，网页启用了GZip压缩。

您可能感兴趣的文档:

点击免费下载>>软考高级考试备考技巧/历年真题/备考精华资料

--结束END--

本文标题: php如何只抓取网页头

本文链接: https://www.lsjlt.com/news/278.html(转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

本篇文章演示代码以及资料文档资料下载

下载Word文档到电脑，方便收藏和打印～

下载Word文档

去做题

猜你喜欢

php如何只抓取网页头

本文操作环境：windows7系统、PHP7.1版、DELL G3电脑php如何只抓取网页头？php获取网页header信息的4种方法php获取网页header信息的方法多种多样，就php语言来说，我知道的方法有4种, 下面逐一献上。方法一...

99+

2019-01-18

php
php如何抓取网页数据

在PHP中，可以使用cURL库来抓取网页数据。cURL（Client URL）是一个用于在PHP中进行网络通信的库，可以发送HTTP...

99+

2023-09-15

php
怎么用php抓取网页数据

使用PHP抓取网页数据可以使用cURL库或者file_get_contents函数。以下是两种方法的示例：1. 使用cURL库抓取网...

99+

2023-09-26

php
如何使用Requests模块抓取网页

这篇文章主要介绍“如何使用Requests模块抓取网页”的相关知识，小编通过实际案例向大家展示操作过程，操作方法简单快捷，实用性强，希望这篇“如何使用Requests模块抓取网页”文章能帮助大家解决问题。爬取网页其实就是通过URL获取网页信...

99+

2023-07-06
PHP网页抓取之抓取百度贴吧邮箱数据代码分享

百度贴吧大家都经常逛，去逛百度贴吧的时候，经常会看到楼主分享一些资源，要求留下邮箱，楼主才给发。对于一个热门的帖子，留下的邮箱数量是非常多的，楼主需要一个一个的去复制那些回复的邮箱，然后再粘贴发送邮件，...

99+

2022-06-04

贴吧取之邮箱
python如何实现基本的抓取网页

这篇文章主要介绍了python如何实现基本的抓取网页，具有一定借鉴价值，感兴趣的朋友可以参考下，希望大家阅读完这篇文章之后大有收获，下面让小编带着大家一起了解一下。基本抓取网页get方法import urllib2url ...

99+

2023-06-17
php抓取网页特定div区块及图片，

取得指定网页內的所有图片： ...

99+

2023-09-09

php java 开发语言
VB.NET抓取网页出现错误如何解决

本篇内容主要讲解“VB.NET抓取网页出现错误如何解决”，感兴趣的朋友不妨来看看。本文介绍的方法操作简单快捷，实用性强。下面就让小编来带大家学习“VB.NET抓取网页出现错误如何解决”吧!VB.NET编程语言特点比较突出，它是一个真正的实现...

99+

2023-06-17
PHP的cURL库功能简介抓取网页、POST数据及其他

无论是你想从从一个链接上取部分数据，或是取一个XML文件并把其导入数据库，那怕就是简单的获取网页内容，反应釜cURL 是一个功能强大的PHP库。本文主要讲述如果使用这个PHP库。　...

99+

2022-11-21

PHP cURL库
PHP中如何进行网络爬虫和数据抓取？

随着互联网时代的到来，网络数据的爬取与抓取已成为许多人的日常工作。在支持网页开发的程序语言中，PHP以其可扩展性和易上手的特点，成为了网络爬虫和数据抓取的热门选项。本文将从以下几个方面介绍PHP中如何进行网络爬虫和数据抓取。一、HTTP协议...

99+

2023-05-20

PHP 网络爬虫数据抓取
php curl如何只获取数据

这篇文章主要介绍“php curl如何只获取数据”，在日常操作中，相信很多人在php curl如何只获取数据问题上存在疑惑，小编查阅了各式资料，整理出简单好用的操作方法，希望对大家解答”php curl如何只获取数据”的疑惑有所帮助！接下来...

99+

2023-06-25
如何使用Python抓取今日头条街拍图片数据

这篇文章主要介绍了如何使用Python抓取今日头条街拍图片数据，具有一定借鉴价值，感兴趣的朋友可以参考下，希望大家阅读完这篇文章之后大有收获，下面让小编带着大家一起了解一下。（1）抓取今日头条街拍图片（2）分析今日头条街拍图片结构keywo...

99+

2023-06-22
php抓取不到数据如何解决

这篇文章主要介绍了php抓取不到数据如何解决的相关知识，内容详细易懂，操作简单快捷，具有一定借鉴价值，相信大家阅读完这篇php抓取不到数据如何解决文章都会有所收获，下面我们一起来看看吧。php抓取不到数据的解决办法：1、在服务器使用“$pa...

99+

2023-07-04
php如何只取前几个字符

这篇文章将为大家详细讲解有关php如何只取前几个字符，小编觉得挺实用的，因此分享给大家做个参考，希望大家阅读完这篇文章后可以有所收获。php只取前几个字符的方法：首先创建一个PHP示例文件；然后定义一个字符串；最后通过“substr...

99+

2023-06-20
php如何只获取中文字符

这篇文章主要介绍“php如何只获取中文字符”的相关知识，小编通过实际案例向大家展示操作过程，操作方法简单快捷，实用性强，希望这篇“php如何只获取中文字符”文章能帮助大家解决问题。php中可用preg_match_all()配合正则表达式过...

99+

2023-06-30
php中如何只获取文件名

php中如何只获取文件名？针对这个问题，这篇文章详细介绍了相对应的分析和解答，希望可以帮助更多想解决这个问题的小伙伴找到更简单易行的方法。php只获取文件名的方法：首先创建一个PHP示例文件；然后通过“basename($file_path...

99+

2023-06-15
php如何获取网页内的视频

PHP可以通过以下几种方法获取网页内的视频：1. 使用DOM解析器：PHP提供了许多DOM解析器，例如DOMDocument和Sim...

99+

2023-09-15

php
利用JavaCV如何实现抓取并保存摄像头的影像

今天就跟大家聊聊有关利用JavaCV如何实现抓取并保存摄像头的影像，可能很多人都不太了解，为了让大家更加了解，小编给大家总结了以下内容，希望大家根据这篇文章可以有所收获。实现：import java.awt.Graphics2D; impo...

99+

2023-05-31

javacv ava
如何在Python中进行网络数据抓取

如何在Python中进行网络数据抓取网络数据抓取是指从互联网上获取信息的过程，在Python中，有许多强大的库可以帮助我们实现这个目标。本文将介绍如何使用Python进行网络数据抓取，并提供具体的代码示例。安装必要的库在开始之前，我们需要安...

99+

2023-10-22

数据抓取 Python编程网络数据抓取
如何解决网站存在抓取的错误

本篇内容主要讲解“如何解决网站存在抓取的错误”，感兴趣的朋友不妨来看看。本文介绍的方法操作简单快捷，实用性强。下面就让小编来带大家学习“如何解决网站存在抓取的错误”吧!　　不抓取如何会收录，又怎么有排名然而就这样一个明显的问题，却有大量的网...

99+

2023-06-10