爬某网站延禧宫率第一集视频

python 复制代码
import requests
import re
from tqdm import tqdm
# 网址链接:https://v.ijujitv.cc/play/24291-1-1.html
url = 'https://v6.1080pzy.co/20220801/urxniJCN/hls/index.m3u8'
headers = {
    "User-Agent":"Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/120.0.0.0 Safari/537.36",
    "Referer":"https://jx.ijujitv.cc/"
}

m3u8_data = requests.get(url=url,headers=headers).text
m3u8_data = re.sub("#EXTM3U",'',m3u8_data)
m3u8_data = re.sub("#EXT-X-VERSION:\d",'',m3u8_data)
m3u8_data = re.sub("#EXT-X-TARGETDURATION:\d",'',m3u8_data)
m3u8_data = re.sub("#EXT-X-PLAYLIST-TYPE:VOD",'',m3u8_data)
m3u8_data = re.sub("#EXT-X-MEDIA-SEQUENCE:\d",'',m3u8_data)
m3u8_data = re.sub("#EXTINF:\d\.\d+,",'',m3u8_data)
m3u8_data = re.sub("#EXTINF:\d,",'',m3u8_data)
m3u8_data = re.sub("#EXT-X-ENDLIST",'',m3u8_data).split()
for m3u8_url in tqdm(m3u8_data):
    content = requests.get(url=m3u8_url,headers=headers).content
    with open('延禧宫率'+'.mp4',mode='ab') as f:
        f.write(content)

爬取的页面如下:

爬取步骤:

又点击检查-network-xhr,发现有许多ts文件,复制浏览即会下载。-在搜索框搜索m3u8,找到一个html的包,如下。

点开后发现其为:

得到了所有ts的包,进行访问提取所有的ts路径代码。

相关推荐
Serendipity_Carl8 小时前
爬取电影数据结合Flask实现数据可视化
爬虫·python·pycharm·数据分析·flask·数据可视化
lilili啊啊啊13 小时前
怎么抓取ios 移动app的https请求?
爬虫·ios·https·抓包·代理抓包·解密https抓包
白雪公主的后妈1 天前
Python爬虫基础——XPath表达式
爬虫·python·lxml·etree
重剑无锋10241 天前
【《python爬虫入门教程12--重剑无峰168》】
开发语言·爬虫·python
数据小小爬虫1 天前
1688平台商品关键词搜索的多样性与Python爬虫应用实践
爬虫
数据小爬虫@2 天前
利用Python爬虫获取淘宝店铺所有商品信息案例指南
开发语言·爬虫·python
m0_748245342 天前
基于大数据爬虫+Python+数据可视化大屏的慧游数据爬虫与推荐分析系统(源码+论文+PPT+部署文档教程等)
大数据·爬虫·python
蹦蹦跳跳真可爱5892 天前
Python----Python爬虫(selenium的使用,处理弹窗,拖拽元素,调用js方法,等待元素,参数使用)
爬虫·python·selenium
Jason-河山2 天前
如何利用Java爬虫批量获取商品信息
java·开发语言·爬虫
Serendipity_Carl2 天前
爬虫基础之爬取某基金网站+数据分析
爬虫·python·pycharm·数据分析·数据可视化