第四章:数据操作Ⅰ 第二节:读写CSV文件

一、基本操作

使用read.csv函数,可以将CSV文件读入数据框,而使用write.csv()函数,则可以将数据框保存到CSV中

我们使用read.csv()的时候,其会返回一个数据框

例如:

1.使用head(变量名,n=显示行数)或者tail(变量名,n=显示行数)来输出文件n数量的头部或者尾部,n不设定的话默认六行

例如:读取学分文件(以下为待读取文件)

使用head格式到R语言中取前面数据

使用tail格式到R语言中取后面数据

2.使用header=T/F选中是否将第一行作为变量名称

例如:

当header=T时

当header=F时,可以看见标题行都变成了V1、V2

3.使用skip=跳过行数,直接从n+1行开始读取数据

例如:当未设置skip时

设置了skip=4时

4.使用nrows=读取指定行数

例如读取5行

配合skip使用可以实现中间截取数据

例如读取4~7行数据

5.使用na.strings='失值的形式',来处理缺失值,将其转化为NA

例如将学分0.2作为失值形式

6.使用stringasfactor=T/F,将读入的字符串是否转化为因子

示例代码

R 复制代码
 # 读取数据文件,并将字符串转化为因子(默认行为)

data <-read.csv("file.csv",stringAsFactors =TRUE)# 读取数据文件,将字符串保持为字符型变量

R在读取数据时,数字会被读取为数值型数据,但是读取字符串时,会默认将数据读取成为因子类型,但是我们并不需要,因此将其设置为F即可

7.na.string参数

有时候在使用read.csv()读入数据的时候,由于出现了NA或者NIL等字符串,R语言会默认将其转化为因子或者字符串,导致整个列被转化为因子或字符串,因此我们可以使用na,string进行转换

例如

我们在使用na.string后可以得到

因此直接能够将其NA或者NULL判别出来进行处理转换成正确的值

相关推荐
吴声子夜歌43 分钟前
ApacheCommons——commons-pool2(高性能通用对象池框架)
java·开发语言·apache
kruptos6 小时前
分布式系统怎么“选主“?Raft 共识一次讲清
开发语言·分布式·php·共识算法
吴声子夜歌6 小时前
ApacheCommons——commons-cli(命令行参数解析)
java·开发语言·apache
benchmark_cc7 小时前
REST API 和 Python SDK 应该怎么选?量化交易数据接口选型实战
开发语言·python·数据分析·pandas·量化交易·股票数据·quantdash
王的宝库7 小时前
Go 项目结构:从单文件到标准工程布局
开发语言·后端·golang
Tairitsu_H7 小时前
[C++] 深入理解红黑树:封装set与map
开发语言·c++·set·map·红黑树·模拟实现
泡海椒8 小时前
JQuick-Curl 性能分析:并发场景下的性能表现与调优,第三方接口调用不只要快写也要稳跑
java·开发语言·okhttp
小智老师PMP8 小时前
2026深度解析|PMP第八版与NPDP核心侧重点本质区别(管理类证书怎么选)
开发语言·分布式·算法·职场和发展·产品经理
HugoStudio_SWAN8 小时前
洛谷 B4450 / B3867 / B3923 智慧购物、储蓄与做题——从程序到生活
c++·学习·程序人生·算法·生活
江畔柳前堤9 小时前
前台·中台·后台:2026年AI原生时代的架构全景图
开发语言·人工智能·算法·机器学习·架构·scala·ai-native