R 语言学习教程,从入门到精通,R XML 文件使用(19)

1、R XML 文件

XML 指的是可扩展标记语言(eXtensible Markup Language),XML 被设计用来传输和存储数据。

R 语言读写 XML 文件需要安装扩展包,我们可以在 R 到控制台输入以下命令来安装:

r 复制代码
install.packages("XML", repos = "https://mirrors.ustc.edu.cn/CRAN/")

查看是否安装成功:

r 复制代码
> any(grepl("XML",installed.packages()))
[1] TRUE

创建 sites.xml 文件,xml 文件与测试脚本同一目录下,代码如下:

r 复制代码
<sites>
    <site>
        <id>1</id>
        <name>Google</name>
        <url>www.google.com</url>
        <likes>111</likes>
    </site>
 
    <site>
        <id>2</id>
        <name>Nhooo</name>
        <url>www.cainiaojc.com</url>
        <likes>222</likes>
    </site>
 
    <site>
        <id>3</id>
        <name>Taobao</name>
        <url>www.taobao.com</url>
        <likes>333</likes>
    </site>
</sites>

接下来我们可以使用 XML 包来载入 xml 文件的数据:

r 复制代码
# 载入 XML 包
library("XML")

# 设置文件名
result <- xmlParse(file = "sites.xml")
# 输出结果
print(result)

统计 xml 数据量:

r 复制代码
# 载入 XML 包
library("XML")

# 设置文件名
result <- xmlParse(file = "sites.xml")
# 提取根节点
rootnode <- xmlRoot(result)
# 统计数据量
rootsize <- xmlSize(rootnode)
# 输出结果
print(rootsize)

执行以上代码输出结果为:

r 复制代码
[1] 3

查看节点数据,某一行使用 [ ], 指定的行和列使用 [[ ]]:

r 复制代码
# 载入 XML 包
library("XML")
# 设置文件名
result <- xmlParse(file = "sites.xml")
# 提取根节点
rootnode <- xmlRoot(result)
# 查看第 2 个节点数据
print(rootnode[2])
# 查看第 2 个节点的第  1 个数据
print(rootnode[[2]][[1]])
# 查看第 2 个节点的第 3 个数据
print(rootnode[[2]][[3]])

执行以上代码输出结果为:

r 复制代码
$site
<site>
  <id>2</id>
  <name>Nhooo</name>
  <url>www.cainiaojc.com</url>
  <likes>222</likes>
</site> 
attr(,"class")
[1] "XMLInternalNodeList" "XMLNodeList"        
<id>2</id> 
<url>www.cainiaojc.com</url>

1.1、XML 转为数据列表

以上代码对输出都是 xml 格式,我们使用 xmlToList() 函数可以将文件对数据转为列表格式,更方便读取:

r 复制代码
# 载入 XML 包
library("XML")
# xml 文件数据转为数据框
xmldataframe <- xmlToDataFrame("sites.xml")
print(xmldataframe)

执行以上代码输出结果为:

r 复制代码
 id   name            url likes
1  1 Google www.google.com   111
2  2 Nhooo www.cainiaojc.com   222
3  3 Taobao www.taobao.com   333
相关推荐
郝学胜-神的一滴1 分钟前
Linux进程与线程控制原语对比:双刃出鞘,各显锋芒
linux·服务器·开发语言·数据结构·c++·程序人生
deephub4 分钟前
Lux 上手指南:让 AI 直接操作你的电脑
人工智能·python·大语言模型·agent
Channing Lewis5 分钟前
Python读取excel转成html,并且复制excel中单元格的颜色(字体或填充)
python·html·excel
小钟不想敲代码8 分钟前
Python(一)
开发语言·python
ji_shuke11 分钟前
canvas绘制拖拽箭头
开发语言·javascript·ecmascript
大佬,救命!!!11 分钟前
对算子shape相关的属性值自动化处理
python·算法·自动化·学习笔记·算子·用例脚本·算子形状
qq_3363139314 分钟前
java基础-IO流(缓冲流)
java·开发语言
青岛少儿编程-王老师16 分钟前
CCF编程能力等级认证GESP—C++2级—20251227
java·开发语言·c++
WoY202016 分钟前
本地PyCharm配置远程服务器上的python环境
服务器·python·pycharm
喜欢编程的小菜鸡19 分钟前
2025:中国大数据行业的“价值觉醒”之年——从规模基建到效能释放的历史性转折
大数据