python网络爬虫(零)——认识网页结构

网页一般有三部分组成,分别是HTML(超文本标记语言)、CSS(层叠样式表)、JScript(活动脚本语言)

1.HTML

HTML是整个网页的结构,相当于整个网站的框架。带"<"">"符号都属于HTML的标签,并且标签都是成对出现的。

语法 内容
html 网页
body 内容
div 框架
p 段落
li 列表
hi 标题
a href 超链接

一个简单的html代码如下:

html 复制代码
<html>
<head>
<title>python3爬虫与数据清洗入门</title>
</head>
<body>
<div>
<p>python3爬虫与数据清洗入门</p>
</div>
<ul>
<li><a href="http://www.baidu.com">爬虫</a></li>
<li>数据清洗</li>
</ul>
</div>
</body>
</html>

程序执行效果如下:

2.CSS

CSS表示样式,表示将在下面引用一个CSS,并在CSS中定义了对应的样式。

3. JScript

JScript表示功能,交互的内容和各种特效都在JScript,JScript描述了网站中的各种功能。

如果把网页比喻为人体,那么html就是人的骨架,并且定义了人的五官;CSS表示人的外观细节,即五官长什么样子,JScript表示人的技能。

相关推荐
1373i5 分钟前
【Python】pytorch安装(使用conda)
pytorch·python·conda
keyinf08 分钟前
python网络爬取个人学习指南-(五)
python
kida_yuan26 分钟前
【从零开始】12. 一切回归原点
python·架构·nlp
离越词39 分钟前
C++day8作业
开发语言·c++·windows
小白学大数据1 小时前
构建企业级Selenium爬虫:基于隧道代理的IP管理架构
爬虫·tcp/ip·selenium
℃CCCC1 小时前
请求库-axios
开发语言·华为·网络请求·harmonyos·deveco studio·axios请求·arkts编程
ling__i1 小时前
java day18
java·开发语言
矛取矛求1 小时前
日期类的实现
开发语言·c++·算法
大翻哥哥1 小时前
Python 2025:AI工程化与智能代理开发实战
开发语言·人工智能·python
站大爷IP1 小时前
Python文件处理:从基础操作到实战技巧全解析
python