python网络爬虫(零)——认识网页结构

网页一般有三部分组成,分别是HTML(超文本标记语言)、CSS(层叠样式表)、JScript(活动脚本语言)

1.HTML

HTML是整个网页的结构,相当于整个网站的框架。带"<"">"符号都属于HTML的标签,并且标签都是成对出现的。

语法 内容
html 网页
body 内容
div 框架
p 段落
li 列表
hi 标题
a href 超链接

一个简单的html代码如下:

html 复制代码
<html>
<head>
<title>python3爬虫与数据清洗入门</title>
</head>
<body>
<div>
<p>python3爬虫与数据清洗入门</p>
</div>
<ul>
<li><a href="http://www.baidu.com">爬虫</a></li>
<li>数据清洗</li>
</ul>
</div>
</body>
</html>

程序执行效果如下:

2.CSS

CSS表示样式,表示将在下面引用一个CSS,并在CSS中定义了对应的样式。

3. JScript

JScript表示功能,交互的内容和各种特效都在JScript,JScript描述了网站中的各种功能。

如果把网页比喻为人体,那么html就是人的骨架,并且定义了人的五官;CSS表示人的外观细节,即五官长什么样子,JScript表示人的技能。

相关推荐
qq_1249870753几秒前
基于Hadoop的黑龙江旅游景点推荐系统的设计与实现(源码+论文+部署+安装)
大数据·hadoop·分布式·python·信息可视化
比奇堡派星星几秒前
Linux 平台设备驱动框架详解
linux·开发语言·驱动开发
2501_941878741 分钟前
从限流策略到系统节奏感的互联网工程语法设计与多语言实践随笔分享
java·开发语言
yangpipi-5 分钟前
《C++并发编程实战》第6章 设计基于锁的并发数据结构
开发语言·数据结构·c++
不过如此19517 分钟前
Jira系统中JQL语句的介绍
python·sql·jira
allione8 分钟前
Java设计模式-工厂模式
java·开发语言·设计模式
WKP94189 分钟前
POI操作excel示例
java·开发语言·excel
万岳科技系统开发11 分钟前
开源知识付费源码:实现在线课程系统与会员管理
开发语言·小程序
ejjdhdjdjdjdjjsl13 分钟前
C#控件事件与数据存储实战
开发语言·c#
不过如此195114 分钟前
Python操作Jira实现不同项目之间的Issue同步
python·jira·issue