python爬虫：爬取网站视频

爬虫视频网站 2023-01-31 05:01:31 995人浏览独家记忆

Python 官方文档：入门教程 => 点击学习

摘要

python爬取百思不得姐网站视频：Http://www.budejie.com/video/新建一个py文件，代码如下：#!/usr/bin/Python # -*- coding: UTF-8 -*- import urllib,re

python爬取百思不得姐网站视频：Http://www.budejie.com/video/

新建一个py文件，代码如下：

#!/usr/bin/Python
# -*- coding: UTF-8 -*-

import urllib,re,requests
import sys
reload(sys)
sys.setdefaultencoding('utf-8')

url_name = [] #url name

def get():
    #获取源码
    hd = {"User-Agent":"Mozilla/5.0 (windows NT 6.3; Win64; x64) AppleWEBKit/537.36 (Khtml, like Gecko) Chrome/58.0.3029.110 Safari/537.36"}
    url = 'http://www.budejie.com/video/'
    html = requests.get(url,headers=hd).text
    url_content = re.compile(r'(<div class="j-r-list-c">.*?</div>.*?</div>)',re.S) #编译
    url_contents = re.findall(url_content,html) #匹配

    for i in url_contents:
        #匹配视频
        url_reg = r'data-mp4="(.*?)"'  #视频地址
        url_items = re.findall(url_reg,i)
        #print url_items
        if url_items:  #判断视频是否存在
            name_reg = re.compile(r'<a href="/detail-.{8}?.html">(.*?)</a>',re.S)
            name_items = re.findall(name_reg,i)
            #print name_items[0]
            for i,k in zip(name_items,url_items):
                url_name.append([i,k])
                print i,k
    for i in url_name:  #i[1]=url i[0]=name
        urllib.urlretrieve(i[1],'video\\%s.mp4' % (i[0].decode('utf-8')))

if __name__ == "__main__":
    get()

在 py 文件下新建一个 video 文件夹，执行后结果如下：

在 video 文件夹可以看到下载好的视频

注意报错：

UnicodeEncodeError: 'ascii' codec can't encode characters in position 0-9: ordinal not in range(128)

解决：

import sys
reload(sys)

sys.setdefaultencoding('utf-8')

您可能感兴趣的文档:

点击免费下载>>软考高级考试备考技巧/历年真题/备考精华资料

--结束END--

本文标题: python爬虫：爬取网站视频

本文链接: https://www.lsjlt.com/news/188215.html(转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

本篇文章演示代码以及资料文档资料下载

下载Word文档到电脑，方便收藏和打印～

下载Word文档

去做题

猜你喜欢

python爬虫：爬取网站视频

python爬取百思不得姐网站视频：http://www.budejie.com/video/新建一个py文件，代码如下：#!/usr/bin/python # -*- coding: UTF-8 -*- import urllib,re...

99+

2023-01-31

爬虫视频网站
python爬虫爬网站的视频和图片

环境：centos6.5 python2.6.6 http://www.budejie.com/（纯属测试，并无恶意）网站分析：我们点视频按钮可以看到url是：http://www.budejie.com/video/接着我们点开...

99+

2023-01-31

爬虫图片网站
python爬取视频网站m3u8视频，下

最近发现一些网站，可以解析各大视频网站的vip。仔细想了想，这也算是爬虫呀，爬的是视频数据。首先选取一个视频网站，我选的是影视大全，然后选择上映不久的电影 “一出好戏” 。分析页面我用的是chrome浏览器，F12进入查看。选...

99+

2023-01-30

视频网站 python
Python爬虫教你爬取视频内容

前面介绍了基本的数据爬取，图片爬取的相关案例前面文章也有涉及，关于有些案例网站不能登录的问题，可以再找些别的网站，因为道理既然明白了，其实什么网站都一样，它有反爬机制，自然有应对它的办...

99+

2023-09-16

爬虫音视频 python
Python爬虫爬取网站图片

此次python3主要用requests，解析图片网址主要用beautiful soup，可以基本完成爬取图片功能，爬虫这个当然大多数人入门都是爬美女图片，我当然也不落俗套，首先也...

99+

2022-11-12
Python爬虫：爬取美拍小姐姐视频

最近在写一个应用，需要收集微博上一些热门的视频，像这些小视频一般都来自秒拍，微拍，美拍和新浪视频，而且没有下载的选项，所以只能动脑想想办法了。第一步分析网页源码。例如：http://video.weibo.com/show...

99+

2023-01-30

爬虫姐姐视频
Python爬虫爬取各大热门短视频平台视频

1、开发工具 Python3.9 requests库其他一些Python内置库 pycharm 2、第三方库安装第三方库 pip install requests 3、实现思路利用tkinter库实例化一个GUI界面，包含提示框...

99+

2023-09-10

python 爬虫
使用Python爬虫怎么避免频繁爬取网站

这期内容当中小编将会给大家带来有关使用Python爬虫怎么避免频繁爬取网站，文章内容丰富且以专业的角度为大家分析和叙述，阅读完这篇文章希望大家可以有所收获。python的数据类型有哪些python的数据类型：1. 数字类型，包括int（整型...

99+

2023-06-15
如何用Python爬虫爬取美剧网站

如何用Python爬虫爬取美剧网站，很多新手对此不是很清楚，为了帮助大家解决这个难题，下面小编将为大家详细讲解，有这方面需求的人可以来学习下，希望你能有所收获。爬虫爬取美剧网站！【前言】一直有爱看美剧的习惯，一方面锻炼一下英语听力，一方面打...

99+

2023-06-02
Python爬虫实战之虎牙视频爬取附源码

目录知识点开发环境分析目标url开始代码最开始还是线导入所需模块数据请求获取视频标题以及url地址获取视频id保存数据调用函数运行代码，得到数据知识点爬虫基本流程 ...

99+

2022-11-12
Python 自动爬取B站视频

文件名自定义（文件格式为.py），脚本内容: #!/usr/bin/env python #-*-coding:utf-8-*- import requests import random import time def get_js...

99+

2023-01-30

视频 Python
python3爬虫（4）各种网站视频下载

理论上来讲只要是网上（浏览器）能看到图片，音频，视频，都能够下载下来，然而实际操作的时候也是有一定难度和技术的，这篇文章主要讲述各个网站视频资源如何下载。 B站视频页面链接： https://www.bilibili.com/ban...

99+

2023-01-31

爬虫视频下载网站
Python爬虫实例爬取网站搞笑段子

众所周知，python是写爬虫的利器，今天作者用python写一个小爬虫爬下一个段子网站的众多段子。目标段子网站为“http://ishuo.cn/”，我们先分析其下段子的所在子页的url特点，可以轻易发...

99+

2022-06-04

爬虫段子实例
如何利用Python爬虫爬取网站音乐

小编给大家分享一下如何利用Python爬虫爬取网站音乐，相信大部分人都还不怎么了解，因此分享这篇文章给大家参考一下，希望大家阅读完这篇文章后大有收获，下面让我们一起去了解一下吧！具体实现引入发送网络请求的第三方库import re...

99+

2023-06-15
如何使用Python爬虫爬取网站图片

这篇文章主要介绍了如何使用Python爬虫爬取网站图片，具有一定借鉴价值，感兴趣的朋友可以参考下，希望大家阅读完这篇文章之后大有收获，下面让小编带着大家一起了解一下。此次python3主要用requests，解析图片网址主要用beautif...

99+

2023-06-22
python爬取小视频

python爬取小视频记录学习python简单爬虫小程序，记录代码和学习过程环境信息 python 2.7.12 分析与步骤要分析网站信息 http://www.budejie.com/video/ 查看网页不同页面的信息...

99+

2023-01-31

小视频 python
Python短视频爬虫教程

好难受，上次发了做游戏的居然没人看，每天为了给你们写啥，老夫心都操碎了~ 真的是，今天来给大家爬一波短视频网站吧，都是些很养眼的~ 网站地址在代码里面，大家用心一下就能看到了。 ...

99+

2022-11-12
Python爬虫之爬取哔哩哔哩热门视频排行榜

目录一、bs4解析二、xpath解析三、xpath解析（二值化处理后展示图片）四、分析过程一、bs4解析 import requests from bs4 import Beau...

99+

2022-11-12
Python爬虫爬取美剧网站的实现代码

一直有爱看美剧的习惯，一方面锻炼一下英语听力，一方面打发一下时间。之前是能在视频网站上面在线看的，可是自从广电总局的限制令之后，进口的美剧英剧等貌似就不在像以前一样同步更新了。但是，作为一个宅diao的我又...

99+

2022-06-04

爬虫美剧代码
python爬虫爬取赶集网数据

一.创建项目 scrapy startproject putu 二.创建spider文件 scrapy genspider patubole patubole.com 三.利用chrome浏览器分析出房价和标题的两个字段的x...

99+

2023-01-31

爬虫数据赶集网