python: 爬虫利器requests

爬虫利器 python 2023-01-31 02:01:12 805人浏览薄情痞子

Python 官方文档：入门教程 => 点击学习

摘要

requests并不是系统自带的模块，他是第三方库，需要安装才能使用闲话少说，来，让我们上代码：简单的看一下效果： import requests requests = requests.session() headers = {

requests并不是系统自带的模块，他是第三方库，需要安装才能使用

闲话少说，来，让我们上代码：
简单的看一下效果：

import requests
requests = requests.session()
headers = {
    'User-Agent':'Mozilla/5.0 (windows NT 10.0; Win64; x64; rv:57.0) Gecko/20100101 Firefox/57.0'
}
url = "Http://httpbin.org"
response = requests.get(url, headers=headers, timeout=None)
print(response.text)
print(response.cookies)
print(response.content)
print(response.content.decode("utf-8"))
print(respone.JSON())

基本的post请求：

data = {
    "name":"zhaofan",
    "age":23
}
response = requests.post("http://httpbin.org/post",data=data)
print(response.text)

对于无效的网站证书请求方法：

import requests
from requests.packages import urllib3
urllib3.disable_warnings()
response = requests.get("https://www.12306.cn",verify=False)
print(response.status_code)

代理设置：

import requests

proxies= {
    "http":"http://127.0.0.1:9999",
    "https":"http://127.0.0.1:8888"
}
response  = requests.get("https://www.baidu.com",proxies=proxies)
print(response.text)

如果代理需要设置账户名和密码,只需要将字典更改为如下：
proxies = {
"http":"http://user:passWord@127.0.0.1:9999"
}
如果你的代理是通过sokces这种方式则需要pip install "requests[socks]"
proxies= {
"http":"socks5://127.0.0.1:9999",
"https":"sockes5://127.0.0.1:8888"
}

超时设置

通过timeout参数可以设置超时的时间

没有超时时间，一直等待
timeout=None

异常捕捉：

import requests

from requests.exceptions import ReadTimeout,ConnectionError,RequestException

try:
    response = requests.get("http://httpbin.org/get",timout=0.1)
    print(response.status_code)
except ReadTimeout:
    print("timeout")
except ConnectionError:
    print("connection Error")
except RequestException:
    print("error")

您可能感兴趣的文档:

点击免费下载>>软考高级考试备考技巧/历年真题/备考精华资料

--结束END--

本文标题: python: 爬虫利器requests

本文链接: https://www.lsjlt.com/news/185601.html(转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

本篇文章演示代码以及资料文档资料下载

下载Word文档到电脑，方便收藏和打印～

下载Word文档

去做题

猜你喜欢

python: 爬虫利器requests

requests并不是系统自带的模块，他是第三方库，需要安装才能使用闲话少说，来，让我们上代码：简单的看一下效果： import requests requests = requests.session() headers = { ...

99+

2023-01-31

爬虫利器 python
requests-html爬虫利器介绍

爬虫用的最多的包无非就是requests, urllib,然后再利用pyquery或者bs4,xpath再去整理提取需要的目标数据。在requests-html里面只需要一步就可以完成而且可以直接进行js渲染.requests的作者Kenn...

99+

2023-01-30

爬虫利器 requests
python爬虫之利用Selenium+Requests爬取拉勾网

目录一、前言二、分析url三、获取所有城市和页数四、生成params参数五、获取数据六、总结一、前言利用selenium+requests访问页面爬取拉勾网招聘信息二、分析url...

99+

2022-11-12
Requests爬虫

　　之前写过一个urllib的爬虫方法，这个库是python内建的，从那篇文章也可以看到，使用起来很繁琐。现在更流行的一个爬虫库就是requests，他是基于urllib3封装的，也就是将之前比较繁琐的步骤封装到一块，更适合人来使用。 ...

99+

2023-01-30

爬虫 Requests
Python3爬虫利器:requests怎么安装

这篇文章主要介绍了Python3爬虫利器:requests怎么安装，具有一定借鉴价值，感兴趣的朋友可以参考下，希望大家阅读完这篇文章之后大有收获，下面让小编带着大家一起了解一下。python可以做什么Python是一种编程语言，内置了许多有...

99+

2023-06-14
Python3 爬虫 requests

刚学Python爬虫不久，迫不及待的找了一个网站练手，新笔趣阁：一个小说网站。安装Python以及必要的模块（requests，bs4），不了解requests和bs4的同学可以去官网看个大概之后再回来看教程刚开始写爬虫的小白都有...

99+

2023-01-31

爬虫 requests
Python爬虫之Requests库的基

1 import requests 2 response = requests.get('http://www.baidu.com/') 3 print(type(response)) 4 print(response....

99+

2023-01-30

爬虫 Python Requests
python爬虫怎么利用requests制作代理池s

本篇内容介绍了“python爬虫怎么利用requests制作代理池s”的有关知识，在实际案例的操作过程中，不少人都会遇到这样的困境，接下来就让小编带领大家学习一下如何处理这些情况吧！希望大家仔细阅读，能够学有所成！　　爬取代理然后验证代理，...

99+

2023-06-02
Python 爬虫利器 Selenium

前面几节，我们学习了用 requests 构造页面请求来爬取静态网页中的信息以及通过 requests 构造 Ajax 请求直接获取返回的 JSON 信息。还记得前几节，我们在构造请求时会给请求加上浏览器 headers,目的就是为了让...

99+

2023-01-30

爬虫利器 Python
Python爬虫Requests库如何使用

本篇内容主要讲解“Python爬虫Requests库如何使用”，感兴趣的朋友不妨来看看。本文介绍的方法操作简单快捷，实用性强。下面就让小编来带大家学习“Python爬虫Requests库如何使用”吧!1、安装 requests 库因为学习过...

99+

2023-07-06
python爬虫中requests库怎么用

小编给大家分享一下python爬虫中requests库怎么用，相信大部分人都还不怎么了解，因此分享这篇文章给大家参考一下，希望大家阅读完这篇文章后大有收获，下面让我们一起去了解一下吧！python爬虫—requests库的用法request...

99+

2023-06-25
python3爬虫-通过requests

import requests from fake_useragent import UserAgent from lxml import etree from urllib.parse import urljoin import py...

99+

2023-01-31

爬虫 requests
Python爬虫Requests库的使用详情

目录一、Requests库的7个主要的方法二、Response对象的属性三、爬取网页通用代码四、Resquests库的常见异常五、Robots协议展示六、案例展示一、Requests...

99+

2022-11-11
Python爬虫之requests库基本介绍

目录一、说明二、基本用法：总结一、说明 requests是一个很实用的Python HTTP客户端库，爬虫和测试服务器响应数据时经常会用到，requests是Python语言的第三方...

99+

2022-11-13
python爬虫入门教程--利用requests构建知乎API（三）

前言在爬虫系列文章优雅的HTTP库requests 中介绍了 requests 的使用方式，这一次我们用 requests 构建一个知乎 API，功能包括：私信发送、文章点赞、用户关注等，因为任何涉及用...

99+

2022-06-04

爬虫入门教程 python
python爬虫之requests库的使用详解

目录python爬虫—requests库的用法基本的get请求带参数的GET请求：解析json使用代理获取cookie会话维持证书验证设置超时异常捕获异常处理总结 python爬虫...

99+

2022-11-12
Python爬虫urllib和requests的区别详解

我们讲了requests的用法以及利用requests简单爬取、保存网页的方法，这节课我们主要讲urllib和requests的区别。 1、获取网页数据第一步，引入模块。两者引入...

99+

2022-11-12
Python网络爬虫requests库怎么使用

1. 什么是网络爬虫简单来说，就是构建一个程序，以自动化的方式从网络上下载、解析和组织数据。就像我们浏览网页的时候，对于我们感兴趣的内容我们会复制粘贴到自己的笔记本中，方便下次阅读浏览——网络爬虫帮我...

99+

2023-05-15

Python Requests
Python网络爬虫requests库如何使用

这篇文章主要讲解了“Python网络爬虫requests库如何使用”，文中的讲解内容简单清晰，易于学习与理解，下面请大家跟着小编的思路慢慢深入，一起来研究和学习“Python网络爬虫requests库如何使用”吧！1. 什么是网络爬虫简单来...

99+

2023-07-06
Python爬虫利器二之Beautif

上一节我们介绍了正则表达式，它的内容其实还是蛮多的，如果一个正则匹配稍有差池，那可能程序就处在永久的循环之中，而且有的小伙伴们也对写正则表达式的写法用得不熟练，没关系，我们还有一个更强大的工具，叫Beautiful Soup，有了它我们可...

99+

2023-01-31

爬虫利器 Python