python网络爬虫(零)——认识网页结构

网页一般有三部分组成,分别是HTML(超文本标记语言)、CSS(层叠样式表)、JScript(活动脚本语言)

1.HTML

HTML是整个网页的结构,相当于整个网站的框架。带"<"">"符号都属于HTML的标签,并且标签都是成对出现的。

语法 内容
html 网页
body 内容
div 框架
p 段落
li 列表
hi 标题
a href 超链接

一个简单的html代码如下:

html 复制代码
<html>
<head>
<title>python3爬虫与数据清洗入门</title>
</head>
<body>
<div>
<p>python3爬虫与数据清洗入门</p>
</div>
<ul>
<li><a href="http://www.baidu.com">爬虫</a></li>
<li>数据清洗</li>
</ul>
</div>
</body>
</html>

程序执行效果如下:

2.CSS

CSS表示样式,表示将在下面引用一个CSS,并在CSS中定义了对应的样式。

3. JScript

JScript表示功能,交互的内容和各种特效都在JScript,JScript描述了网站中的各种功能。

如果把网页比喻为人体,那么html就是人的骨架,并且定义了人的五官;CSS表示人的外观细节,即五官长什么样子,JScript表示人的技能。

相关推荐
克里斯蒂亚诺更新1 分钟前
vue展示node express调用python解析tdms
服务器·python·express
idwangzhen2 分钟前
2026郑州GEO优化哪个平台靠谱
python·信息可视化
程序员良辰5 分钟前
JDK 环境变量的核心作用 ? 如果使用 IDEA 运行程序,是否可以不配置环境变量 ?
java·开发语言·intellij-idea
独自破碎E6 分钟前
【数组】分糖果问题
java·开发语言·算法
charlie1145141919 分钟前
现代嵌入式 C++——自定义删除器(Custom Deleter)
开发语言·c++·笔记·学习·嵌入式
闲谈共视13 分钟前
Go语言与区块链技术的渊源
开发语言·golang·区块链
yaoxin52112313 分钟前
305. Java Stream API - 短路操作
java·开发语言
程序员敲代码吗13 分钟前
C++与硬件交互编程
开发语言·c++·算法
qq_5375626715 分钟前
C++与Java性能对比
开发语言·c++·算法
计算机毕业编程指导师15 分钟前
【Python大数据选题】基于Hadoop+Spark奥运会金牌榜可视化分析系统源码 毕业设计 选题推荐 毕设选题 数据分析 机器学习 数据挖掘
大数据·hadoop·python·计算机·spark·毕业设计·奥运会金牌