python网络爬虫(零)——认识网页结构

网页一般有三部分组成,分别是HTML(超文本标记语言)、CSS(层叠样式表)、JScript(活动脚本语言)

1.HTML

HTML是整个网页的结构,相当于整个网站的框架。带"<"">"符号都属于HTML的标签,并且标签都是成对出现的。

语法 内容
html 网页
body 内容
div 框架
p 段落
li 列表
hi 标题
a href 超链接

一个简单的html代码如下:

html 复制代码
<html>
<head>
<title>python3爬虫与数据清洗入门</title>
</head>
<body>
<div>
<p>python3爬虫与数据清洗入门</p>
</div>
<ul>
<li><a href="http://www.baidu.com">爬虫</a></li>
<li>数据清洗</li>
</ul>
</div>
</body>
</html>

程序执行效果如下:

2.CSS

CSS表示样式,表示将在下面引用一个CSS,并在CSS中定义了对应的样式。

3. JScript

JScript表示功能,交互的内容和各种特效都在JScript,JScript描述了网站中的各种功能。

如果把网页比喻为人体,那么html就是人的骨架,并且定义了人的五官;CSS表示人的外观细节,即五官长什么样子,JScript表示人的技能。

相关推荐
杜杜的man2 分钟前
【go从零单排】迭代器(Iterators)
开发语言·算法·golang
亦世凡华、2 分钟前
【启程Golang之旅】从零开始构建可扩展的微服务架构
开发语言·经验分享·后端·golang
测试界的酸菜鱼16 分钟前
C# NUnit 框架:高效使用指南
开发语言·c#·log4j
GDAL16 分钟前
lua入门教程 :模块和包
开发语言·junit·lua
李老头探索18 分钟前
Java面试之Java中实现多线程有几种方法
java·开发语言·面试
CSXB9919 分钟前
三十四、Python基础语法(文件操作-上)
开发语言·python·功能测试·测试工具
web Rookie39 分钟前
JS类型检测大全:从零基础到高级应用
开发语言·前端·javascript
很楠不爱1 小时前
Qt——窗口
开发语言·qt
yi碗汤园1 小时前
【一文了解】C#基础-集合
开发语言·前端·unity·c#
亚图跨际1 小时前
MATLAB和Python及R潜变量模型和降维
python·matlab·r语言·生物学·潜变量模型