python网络爬虫(零)——认识网页结构

  网页一般有三部分组成,分别是HTML(超文本标记语言)、CSS(层叠样式表)、JScript(活动脚本语言)

1.HTML

  HTML是整个网页的结构,相当于整个网站的框架。带"<"">"符号都属于HTML的标签,并且标签都是成对出现的。

语法 内容
html 网页
body 内容
div 框架
p 段落
li 列表
hi 标题
a href 超链接

  一个简单的html代码如下:

html 复制代码
<html>
<head>
<title>python3爬虫与数据清洗入门</title>
</head>
<body>
<div>
<p>python3爬虫与数据清洗入门</p>
</div>
<ul>
<li><a href="http://www.baidu.com">爬虫</a></li>
<li>数据清洗</li>
</ul>
</div>
</body>
</html>

  程序执行效果如下:

2.CSS

  CSS表示样式,表示将在下面引用一个CSS,并在CSS中定义了对应的样式。

3. JScript

  JScript表示功能,交互的内容和各种特效都在JScript,JScript描述了网站中的各种功能。

  如果把网页比喻为人体,那么html就是人的骨架,并且定义了人的五官;CSS表示人的外观细节,即五官长什么样子,JScript表示人的技能。

相关推荐
caimouse5 分钟前
Reactos 第 5 章 进程与线程 — 5.3 系统调用 NtCreateProcess()
服务器·开发语言
ch.ju10 分钟前
Java程序设计(第3版)第四章——继承的调用
java·开发语言
Elaine33611 分钟前
基于Django框架的静态个人名片网站设计
后端·python·django·mvt
W_LuYi18521 分钟前
Tauri + Rust + Vue 3 打造极速轻量桌面应用
java·开发语言·vue.js·rust
少司府21 分钟前
C++进阶:红黑树
开发语言·数据结构·c++·b树·二叉树·红黑树
数据知道26 分钟前
从Playwright到自研:构建指纹浏览器的技术栈选型与路线图
爬虫·数据采集·指纹浏览器
henrylin999938 分钟前
开源量化软件功能介绍
python·开源
特种加菲猫38 分钟前
哈希表的实现
开发语言·c++
C+-C资深大佬38 分钟前
Python 新手学习指南
开发语言·python
小张小张爱学习41 分钟前
Java基础面试题
java·开发语言