首页 > 资讯 > 后端开发 > Python >Python中requests库的学习方法详解

597

分享到

Python中requests库的学习方法详解

2024-04-02 19:04:59 597人浏览独家记忆

Python 官方文档：入门教程 => 点击学习

摘要

目录前言一 URL，URI和URN1. URL，URI和URN2. URL的组成二请求组成1. 请求方法2. 请求网址3. 请求头4. 请求体三请求1. get请求2. get带

前言

好记性不如烂笔头！最近在接口测试，以及爬虫相关，需要用到python中的requests库，之前用过，但是好久没有用又忘了，这次就把这块的简单整理下（个人笔记使用）

一 URL，URI和URN

1. URL，URI和URN

URI的全称是UnifORM Resource Identiferm，即统一资源标识符，它标记了一个资源，比如Http://www.baidu.com/ 就代表了一个百度网页。

URL的全称是Uniform Resource Locator,即统一资源定位符，是可以通过给出的路径和文件去找到对应的资源，比如 http://tougao.jb51.net/index.PHP?c=index&a=login&forward=http%3A%2F%2Ftougao.jb51.net%2F 这个URL就具体定位了一个资源，是可以根据路径去实时找到资源的。

URN的全称是Uniform Resource Name,即统一资源名称；它只命名资源，不指定任何路径去定位资源。

三者关系：URI包含URL，URN，即URL，URN是URI的子集。如果URI是一栋房的话，那URL是某个具体的房间（123号房），URN可以是房里某个东西（凳子），但不知道这个东西（凳子）具体在哪。如下

![在这里插入图片描述](https://img-blog.csdnimg.cn/a59665b093634913b5355aefa580ca44.png?x-oss-process=image/watermark,type_d3F5LXplbmhlaQ,shadow_50,text_Q1NETiBA5YaZQnVn5LitLi4u,size_15,color_FFFFFF,t_70,g_se,x_16

2. URL的组成

常见URL的组成一般如下，用这个URL做一下分析：http://tougao.jb51.net/index.php?c=index&a=login&forward=http%3A%2F%2Ftougao.jb51.net%2F

1 协议：用于访问资源的协议，如上面用的是https协议进行访问，其它还有http,ftp等协议

2 服务器的主机地址：可以是域名，也可以是IP地址。如上面是域名editor.csdn.net访问

3 端口：服务器设置的访问端口。不过URL地址里一般无端口，因为服务器使用了协议的默认端口，用户通过url访问服务器时，可以省略。如http默认端口是80，https默认端口是443，ftp默认端口是22等。

4 路径：资源存放的路径。一般是域名后的/到？之间的内容，如上就是md

5 参数：具体的查询方式，如上面的URL的参数就是not_checkout=1&articleId=122388528

二请求组成

请求一般是由客户端向服务器端发起的，由4部分组成：请求方法（Request Method），网站（URL），请求头（Request Headers）和请求体（Request Body）。下面详细整理下最常见的get请求和post请求。

1. 请求方法

常见的请求方法如下

GET：请求页面，数据包含在URL里面
POST：大多用于提交表单或者上传文件，数据包含在请求体中
HEAD：类似GET请求，不过响应报文没有具体的内容，用于获取报头
PUT：用客户端传送的数据取代指定的内容
DELETE：请求服务器删除指定的页面
CONNECT：把服务器当作跳板，让服务器代替客户端访问其他网页
OPTioNS：允许客户端查看服务器的性能
TRACE：回显服务器收到的请求，主要用于测试或者诊断

不过我们见到和使用的大多数都是GET和POST请求

2. 请求网址

请求的网址即上面说的URL

3. 请求头

请求头，一般是传送服务器需要的一些附加信息，其中比较重要的就是User-Agent,Referer,Cookie等，常用的请求有说明如下

Accept: 请求报头域，用于指定客户端可接受哪些类型的信息
Accept-Language: 指定客户端可接受的语言类型
Accept-Encoding：指定客户端可接受的编码
Host：用于指定资源主机的IP和端口号，其内容为请求URL的原始服务器或网关的位置
Cookie：网站为了辨别用户进行会话跟踪而存储在用户本地的数据，它的主要功能是维持当前访问会话。
Referer: 用来标识这个请求是从哪个页面发过来的，服务器可以拿到这一信息并做相应的处理，如做资源统计，防盗链接处理等。
User-Agent: 可以是服务器识别客户端使用的操作系统及版本，浏览器及版本信息等。所以在做爬虫时要加上此信息，可以伪装浏览器；不加的话很容易被识别为爬虫。
Conten-Type：互联网媒体类型，用来表示具体请求中媒体类型信息；如text/html代表HTML格式，image/gif代表GIF图片，application/JSON代表jsON类型

4. 请求体

请求体一般POST请求的时候才会有，因为GET请求的信息都在URL里。

三请求

1. get请求

如果我们要发起一个GET请求，直接调用requests库里的GET方法即可，如下

get请求时，请求参数一般放在URL里面，数据可以在URL里面看到

import requests
#get(url)
res = requests.get('http://httpbin.org/get')
print(res.text)

请求网站是 http://httpbin.org/get，它会识别我们发起的是get请求，并返回对应的信息。如下

{"args": {},"headers": {"Accept": "*/*","Accept-Encoding": "gzip, deflate","Host": "httpbin.org","User-Agent": "python-requests/2.22.0","X-Amzn-Trace-Id": "Root=1-61e3c913-38e2ad7e3654947049a3c780"},"origin": "27.38.202.28","url": "http://httpbin.org/get"}

不过不加请求头的话容易被禁止访问，访问知乎https://www.zhihu.com/ 如下

import requests
#get(url)
res = requests.get('http://httpbin.org/get')
res1 = requests.get('https://www.zhihu.com/')
print(res1.text)

在这里插入图片描述

2. get带请求头headers参数

上面看见了，如果我们不构造请求头headers的话，容易被禁止访问，因为浏览器有反爬措施，如下

import requests
#get(url,headers)
res1 = requests.get('https://www.zhihu.com/')
print(res1.text)
for i in res1.request.headers.items():
    print(i)

在这里插入图片描述

结果返回403（禁止访问），因为浏览器会通过User-Agent参数了解到我们的电脑系统以及浏览器等信息，上面不带headers时，默认User-Agent为Python-requests/2.22.0，这服务器一看就知道是脚本，那肯定就会禁止访问。这时就需要重新构造请求头，伪装成浏览器访问，如下

在这里插入图片描述

将上面的user-agent值用代码传送，如下

import requests
#get(url,headers)
headers = {
    'User-Agent': 'Mozilla/5.0 (windows NT 10.0; Win64; x64) AppleWEBKit/537.36 (KHTML, like Gecko) Chrome/92.0.4515.159 Safari/537.36'
}
res1 = requests.get('https://www.zhihu.com/', headers=headers)
print(res1.status_code)
for i in res1.request.headers.items():
    print(i)

在这里插入图片描述

如上，重新构造请求头传了user-agent参数后，请求就成功了，user-agent也是我们传进去的值。

3. post请求

对于post请求，使用requests库发起也是很简单的，如下

import requests
data = {'name': 'anxiaochong', 'age': 24}
res = requests.post('http://httpbin.org/post', data=data)
print(res.status_code)
print(res.text)

对于post请求来说，它的数据在URL里面是看不到的，数据一般存放在请体中，如上，我们发起一个post请求，请求参数是data，当我们请求成功后，它会返回如下信息。

在这里插入图片描述

四响应

当我们发起请求之后，如果一切正常，就会得到相应的响应。我们的最终目的，就是要获取返回的数据，所以对返回的数据进行处理是非常重要的。

1. 响应状态码

状态码能够最基本的判定服务器对请求的响应情况，比如200就是请求成功，301就是重定向，404就是请求资源不存在，500就是服务器错误等，常见的一些如下

200:请求成功，服务器已成功处理请求。

301: 重定向，请求的网页已经移动到新位置

400：请求错误401：未授权，请求没有进行身份验证或者验证未通过

403：禁止访问404：未找到，请求资源不存在500：服务器错误

503：服务器无法使用

python获取响应状态码如下

#获取响应状态码
import requests
data = {'name': 'anxiaochong', 'age': 24}
res = requests.post('http://httpbin.org/post', data=data)
#获取响应状态码
print(res.status_code)

2. 响应头

响应头包含了服务器对请求的一些应答信息，如Server，Content-Type，Set-cookie等信息。如下

在这里插入图片描述

content-type: 返回数据的类型
sever：服务器名称，版本等信息
set-cookie: 会话cookie，下次请求需要带上。

3. 响应体

响应信息中最重要的当属响应体了，因为我们想要获取的信息基本都在里面。python的request库也有对应的方法了提取相关信息，如下

import requests
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/92.0.4515.159 Safari/537.36',
    'Cookie': '_zap=cdbd7845-adac-4d87-ad39-2c6ce8fDDDe3; _xsrf=kD16apiCYLVrAfyvuW45BRI6jkdo4NcX; d_c0="ABDfdUZbRhSPTmuW3ExXOv346BuMQQ2oWaI=|1641098931"; __snaker__id=P7yktK5PgsCmILtR; gdxidpyhxdE=r9dW%2F%2BxGfN1iooAQAiODTGfGh8mPnu43T4g3V7PKabUA7zMCUUys%5CWvuLdjQeB5r8MZAtwRAOKJUQgJonmDPkpo6C4CxSXwNAP%2FMUa1p52udf%5Cu5eqEoiM%5C5QlGEMdgp3PwqG5uSMvzKyXA5WjmVejZdMmvaqwy8Y7MT1SrgLpf0hG3Q%3A1641099836676; _9755xjdesxxd_=32; YD00517437729195%3AWM_NI=VXux5u3T%2BJ6a%2FwURu60bvpw8ui4mkL1mk0xGQnAgn4UlLc5lq9n%2Fq4nkL9dYlDDOpT8bbuEZZueOScQMFx9h6t9pFTxKkjpVf74kC5EdQt6WJ0AsLoU%2FtsViMqPMk64rVjE%3D; YD00517437729195%3AWM_NIKE=9ca17ae2e6ffcda170e2e6ee87e9699686839bdc73b2868ea2d54a839f9eaeb62183bb8ca7f839968f008cf92af0fea7c3b92a9688bb99b87ff18ce5abb56beda99bb3f83ef4beba91f634b7b7fc8eea48f3b3a5d1fb4d93b28f88ed4097b48484b868b3e7a2d0f440aeb584dae753b09c8cb0f360fcbeae96c8529aababb0d26993938a99bc64f6acf791c560bc95a58bf35ea6e9fc8cc23f87bc9fb5b55d8af08f94cf6597f1bc94d5638fafa0aeea3ef8ae9a8bc837e2a3; YD00517437729195%3AWM_TID=gBk1e8TwlKhAABAAUBN6rQOGA%2FnBFhk3; l_cap_id="ODdjYzkzYjc3ODRlNGU5ZGFhZGNlODZjNmVhZjUxOTk=|1641098947|5e1742f2cfb1bc51e01c98dc554a343834ceb4fe"; r_cap_id="NWJjZTUwNzI3NTZkNGRlOGE2MDc4NjZhNTljMjQwMTE=|1641098947|34aeb872f7b2def674441346a0be809d4d3f3818"; cap_id="YThjNTkwZTZiMjY5NGNiNWJmOWJkYjQzNDRjMWE5MDA=|1641098947|7f4062306951584cd44180c28bb8a8fe90d732cd"; captcha_session_v2="2|1:0|10:1641099110|18:captcha_session_v2|88:THV2VWV1eWhIZUZTZmsvR1Yyd2hHRGNPcFc5QTc4bWNHNWVabzBDZ3JPZFRtUDltenRWeE1SUEtuVEZwcTBHSg==|258d6e1ea988e9f89e94208600834adba972038afbbb273aacc3849fa44c2cf9"; z_c0=Mi4xR1ZYa0RRQUFBQUFBRU45MVJsdEdGQmNBQUFCaEFsVk5sMzItWWdEc09nbTQzZWhiejkwTGhyZTRadE1WSlVEeXZR|1641099159|763c9639b7d621f1e9a64d0e246cec75292d7277; Hm_lvt_98beee57fd2ef70ccdd5ca52b9740c49=1641098932,1641217361; tst=h; SESSIONID=gMeSnpcPawUbmk3tMHN6I6Uc2xxUTfnKfx4Pj7xHJ4Z; JOID=VVkVA0wgiAleIRrUbidunj5sRpR9QcRsCk9stj5B-V08S3HhGwmh6jgnHdVpii0jv9C3ZZnJsok4l_oqAxMoR7k=; osd=UVoSCkwkiw5XIR7XaS5umj1rT5R5QsNlCktvsTdB_V47QnHlGA6o6jwkGtxpji4kttCzZp7Aso07kPMqBxAvTrk=; NOT_UNREGISTER_WAITING=1; Hm_lpvt_98beee57fd2ef70ccdd5ca52b9740c49=1642866191; KLBRSID=fe0fceb358d671fa6cc33898c8c48b48|1642866207|1642866103'
}
res = requests.get('https://www.zhihu.com/hot', headers=headers)
print("响应状态码：", res.status_code)
print("响应内容: ", res.text)
print("获取的响应内容类型: ", type(res.text))
print("响应头信息: ", res.headers)
print("获取请求头信息: ", res.request.headers)
print("获取请求体: ", res.request.body)
print("获取cookie: ", res.cookies)
print("cookie类型: ", type(res.cookies))
print("获取编码格式: ", res.encoding)
print("获取请求URL: ", res.url)

总结

本篇文章就到这里了，希望能够给你带来帮助，也希望您能够多多关注编程网的更多内容!

您可能感兴趣的文档:

点击免费下载>>软考高级考试备考技巧/历年真题/备考精华资料

--结束END--

本文标题: Python中requests库的学习方法详解

本文链接: https://www.lsjlt.com/news/139087.html(转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

本篇文章演示代码以及资料文档资料下载

下载Word文档到电脑，方便收藏和打印～

下载Word文档

去做题

猜你喜欢

Python中requests库的学习方法详解

目录前言一 URL，URI和URN1. URL，URI和URN2. URL的组成二请求组成1. 请求方法2. 请求网址3. 请求头4. 请求体三请求1. get请求2. get带...

99+

2022-11-13
Python中requests库的用法详解

目录一、requests库安装请求响应二、发送get请求1、一个带参数的get请求：2、响应json3、添加头信息headers4、添加和获取cookie信息三、发送post请求1、...

99+

2022-11-11
Python中第三方库Requests库的高级用法详解

一、Requests库的安装利用 pip 安装，如果你安装了pip包（一款Python包管理工具，不知道可以百度哟），或者集成环境，比如Python（x,y）或者anaconda的话，就可以直接使用pi...

99+

2022-06-04

第三方详解高级
Python学习之循环方法详解

目录for循环while循环拓展：列表推导式常见的推导式方法循环的继续与退出(continue与break)continue的使用break的使用循环实现九九乘法表什么是循环？ &m...

99+

2022-11-13
python学习：break用法详解

在执行while循环或者for循环时，只要循环条件满足，程序会一直执行循环体。但在某些场景，我们希望在循环结束前就强制结束循环。 Python中有两种强制结束循环的方法： continue语句：跳过执...

99+

2023-09-10

学习 python 开发语言
python使用requests库提交multipart/form-data请求的方法详解

目录前言multipart/form-dataPython 发送 multipart/form-data补充知识：multipart/form-data 参数转码总结前言今天渗透测...

99+

2023-01-17

python multipart/form-data python formdata请求 python multipart/form-data请求
python中requests库session对象的妙用详解

在进行接口测试的时候，我们会调用多个接口发出多个请求，在这些请求中有时候需要保持一些共用的数据，例如cookies信息。妙用1 requests库的session对象能够帮我们跨请求保持某些参数，也会...

99+

2022-06-04

妙用详解对象
python中requests库安装与使用详解

目录前言1、Requests介绍2、requests库的安装3、requests库常用的方法4、response对象的常用属性5、使用requests发送get请求5.1 ...

99+

2022-11-11
python爬虫之requests库的使用详解

目录python爬虫—requests库的用法基本的get请求带参数的GET请求：解析json使用代理获取cookie会话维持证书验证设置超时异常捕获异常处理总结 python爬虫...

99+

2022-11-12
离线安装python的requests库方法

目录前言1、下载安装包1.1 检查requests模块所需依赖包1.2 下载requests所需依赖包1.3 下载requests包2、安装2.1 安装requests所需依赖包2....

99+

2022-11-13
【可解释性机器学习】详解Python的可解释机器学习库：SHAP

详解Python的可解释机器学习库：SHAP SHAP介绍SHAP的用途SHAP的工作原理解释器Explainer局部可解释性Local Interper单个prediction的解释多个预测...

99+

2023-08-31

可解释性 SHAP 全局解释性局部解释性
Android学习之Span的使用方法详解

目录Span集合段落类Span其他Span展示效果小试牛刀小结Span集合段落类Span BulletSpan 为段落开头增加项目符号并支持大小、颜色、弧度 span.append...

99+

2022-11-13
jsp学习之scriptlet的使用方法详解

在JSP中，scriptlet是一种在JSP页面中嵌入Java代码的方式。它被包含在标签中，可以在其中编写任意的Java代码。下面是...

99+

2023-08-11

jsp
Python语法学习之进程的创建与常用方法详解

目录进程的创建模块 - multiprocessing创建进程函数 - Process进程的常用方法start 函数join 函数kill 函数与 is_alive 函数进程的相关...

99+

2022-11-10
Python语法学习之线程的创建与常用方法详解

目录线程的创建与使用线程的创建 -threading线程对象的常用方法线程演示案例线程的问题线程的创建与使用在Python中有很多的多线程模块，其中 threading ...

99+

2022-11-10
Python集成学习之Blending算法详解

目录一、前言二、Blending介绍三、Blending流程图四、案例一、前言普通机器学习：从训练数据中学习一个假设。集成方法：试图构建一组假设并将它们组合起来，集成学习是一种机器学习范式，多个学习器被训练来解决...

99+

2022-06-02

Python Blending算法 python算法
Python机器学习库scikit-learn使用详解

目录前言线性回归模型-LinearRegression准备数据集使用LinearRegression总结前言 scikit-learn是Python中最流行的机器学习库之一，它提供了...

99+

2023-03-19

Python scikit-learn Python 机器学习库
Python标准库学习之psutil内存详解

目录查询CPU信息查询内存信息查询磁盘信息查询网络信息查询进程信息人生苦短，快学Python！今天介绍的是psutil模块，它是一个跨平台库 https://github.com/...

99+

2022-11-12
python标准库学习之sys模块详解

目录前言处理命令行参数sys.exit(n) 退出程序，正常退出时exit(0)sys.version 获取Python解释程序的版本信息sys.platform 返回操作系统平台名...

99+

2022-11-11
SpringJPA学习之delete方法示例详解

目录一、deleteById 和 deletedeleteById(Id id)（通过id进行删除）delete(T entity)（通过实体对象进行删除）实例servic...

99+

2023-05-18

Spring JPA delete方法 Spring JPA delete