【爬虫】爬bibi视频

1. 复制粘贴搜索

2. 利用工具写请求代码

工具网址:Convert curl commands to code

3. 把爬取内容喂给ai

先保存到txt文件

复制代码
# 上面代码是第二部分复制粘贴的
with open('1.txt', 'w') as f:
    f.write(response.text)

问ai:根据txt的内容,查找并提取视频地址和音频地址

以下是ai返回的:

复制代码
import requests
import re
import json

url = 'https://www.bilibili.com/video/BV11GJazAE35/'
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/121.0.0.0 Safari/537.36',
    'Referer': 'https://www.bilibili.com/'
}

response = requests.get(url, headers=headers)
html = response.text

# 方法1:从window.__playinfo__中提取
match = re.search(r'window.__playinfo__=(.*?)</script>', html)
if match:
    play_info = json.loads(match.group(1))
    # 视频地址
    video_url = play_info['data']['dash']['video'][0]['baseUrl']
    # 音频地址
    audio_url = play_info['data']['dash']['audio'][0]['baseUrl']
    print(f"视频地址: {video_url}")
    print(f"音频地址: {audio_url}")

运行结果:

4. 合并视频和音频

这一步我直接 按tab键自动补全的,参考以下代码:

复制代码
from moviepy import VideoFileClip, AudioFileClip
# 加载视频和音频文件
video_clip = VideoFileClip("视频.mp4")
audio_clip = AudioFileClip("视频.mp3")

# 将音频设置为视频的音频
video_clip = video_clip.with_audio(audio_clip)

# 保存合并后的视频
video_clip.write_videofile("合并后的视频.mp4")

完整代码如下:

复制代码
import requests
import re
import json

url = 'https://www.bilibili.com/video/BV11GJazAE35/'
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/121.0.0.0 Safari/537.36',
    'Referer': 'https://www.bilibili.com/'
}

response = requests.get(url, headers=headers)
html = response.text

# 方法1:从window.__playinfo__中提取
match = re.search(r'window.__playinfo__=(.*?)</script>', html)
if match:
    play_info = json.loads(match.group(1))
    # 视频地址
    video_url = play_info['data']['dash']['video'][0]['baseUrl']
    # 音频地址
    audio_url = play_info['data']['dash']['audio'][0]['baseUrl']
    print(f"视频地址: {video_url}")
    print(f"音频地址: {audio_url}")

# 视频
with open('视频.mp4', 'wb') as f:
    f.write(requests.get(video_url, headers=headers).content)
# 音频
with open('视频.mp3', 'wb') as f:
    f.write(requests.get(audio_url, headers=headers).content)


from moviepy import VideoFileClip, AudioFileClip
# 加载视频和音频文件
video_clip = VideoFileClip("视频.mp4")
audio_clip = AudioFileClip("视频.mp3")

# 将音频设置为视频的音频
video_clip = video_clip.with_audio(audio_clip)

# 保存合并后的视频
video_clip.write_videofile("合并后的视频.mp4")

效果如下:

视频也是有声音的。

说明:爬的视频不是高清的,想爬高清的得登陆,在代码中增加对应的参数与请求头等,比如cookie值等。

相关推荐
十三浪1 小时前
开源框架推荐:API数据批处理与爬虫集成
爬虫·开源
小白学大数据9 小时前
高并发爬虫的限流策略:aiohttp实现方案
爬虫
天若有情6731 天前
【python】Python爬虫入门教程:使用requests库
开发语言·爬虫·python·网络爬虫·request
Python智慧行囊1 天前
Selenium 自动化测试与爬虫实战:从环境搭建到高级应用
爬虫·selenium·测试工具
fsnine1 天前
网络爬虫(python)入门
开发语言·爬虫·python
Dreamsi_zh1 天前
Python爬虫07_Requests爬取图片
开发语言·爬虫·python
yzx9910131 天前
关于PHP学习
运维·爬虫·自动化·php
Dreamsi_zh2 天前
Python爬虫02_Requests实战网页采集器
开发语言·爬虫·python
专注VB编程开发20年2 天前
Selenium的进化历程与WebDriver的创新整合,作者Simon Stewart
爬虫·selenium·数据采集·webdriver·simon stewart
Dreamsi_zh2 天前
Python爬虫04_Requests豆瓣电影爬取
开发语言·爬虫·python