初识python爬虫

案例:爬取快手短视频

1.打开快手网站:www.kuaishou.com

2.F12打开网页查看器

3.点击Network,点击media选项

4.切换快手视频,出现媒体视频链接

5.右击复制路径

8.写python代码

python 复制代码
#引入requests模块
import requests
#存放快手某个短视频链接
链接 = 'https://k0u73ydfy1cy13zw240exf7xc010x2302xx13z.djvod.ndcimgs.com/bs2/photo-video-mz/5250071454950664773_d03baabdbfc06727_7056_hd15.mp4?tag=1-1783068280-unknown-0-2qammqlgeu-3c4d22a87af1f028&provider=self&clientCacheKey=3xmf6dcaw85ivq9_508ae070&di=73e2233c&bp=14944&x-ks-ptid=192546889029&kwai-not-alloc=self-cdn&kcdntag=p:Zhejiang;i:ChinaTelecom;ft:UNKNOWN;h:COLD;pn:kuaishouVideoProjection&ocid=300000238&tt=hd15&ss=vpm'
#get方法:向服务器发送网络请求。content:获取网络请求成功后返回的数据
数据 = requests.get(链接).content
#打印输出
#open()方法:打开文件。wb:以二进制写的方式打开文件。write()方法:写数据
open('短视频.mp4','wb').write(数据)

# 媒体爬虫流程:
# 1.打开媒体网站
# 2.右击网站->检查->网络->媒体
# 3.播放视频/音乐,在媒体栏目中会出现视频或音乐的资源,右击该资源后选择复制网址
# 4.编写代码,运行,播放生成的音乐/视频

9.运行代码,在当前目录下生成短视频.mp4视频文件

相关推荐
梅孔立2 天前
Fiddler 工具安装抓包 教程 https
爬虫
feasibility.2 天前
MediaCrawler媒体采集平台安装与使用
爬虫·抖音·小红书·微博·bili
Patrick在香港3 天前
Claude 工具调用返回空:8 次失败里只有 1 次状态码不对,其余全带 200
爬虫·python·api·claude·香港
小静AI工程实验室4 天前
Python 爬虫中文乱码排查:严格解码、UTF-8 BOM 与 JSON 转义的 12 项实验
字符编码·爬虫·python
咖啡星人k4 天前
从自建爬虫到托管工具:数据采集选型对照表
爬虫·数据采集·mcp
电商API_180079052475 天前
拍照找同款是怎么实现的?淘宝以图搜图接口 item_search_img 对接实战
大数据·爬虫·数据挖掘·数据分析·代采api
Patrick在香港5 天前
Python 抓 0.91 GB 香港法例:Agent 的进度该写进磁盘,不是写进上下文
爬虫·python·api·claude·香港
Experience-摆渡5 天前
开源RAG知识库WeKnora深度调研:让知识自己长成体系
爬虫·docker·开源·rag
孙启超6 天前
【AI开发之Rust】第 7 课:错误处理 —— panic、Result 与 `?`
人工智能·分布式·后端·爬虫·spring cloud·架构·rust
该逃避避6 天前
IP代理类型介绍:住宅IP、机房IP、移动IP等区别与选择
爬虫