介绍一个在数据分析中常用的函数:data.iloc[]

平时处理数据集中,总是需要选中一些列的数据,去预测其他列的数据,所以data.iloc[],在数据分析中显得尤为方便。

介绍一下data.iloc[]

data.iloc[] 是 Python 中 pandas 库的一个非常有用的功能,它允许你通过行和列的整数位置索引来选择数据。iloc 是 "integer location" 的缩写,意味着你可以通过指定行和列的整数索引来选择数据,而不是使用标签。

以下是一些使用 data.iloc[] 的基本示例:

  1. 选择单个元素

    使用 data.iloc[row_index, column_index] 来选择特定的元素。

    python 复制代码
    element = data.iloc[0, 1]  # 选择第1行第2列的元素
  2. 选择一行

    使用 data.iloc[i,:] 来选择第 i 行的所有列。

    python 复制代码
    row = data.iloc[2, :]  # 选择第3行的所有列
  3. 选择一列

    使用 data.iloc[:, j] 来选择第 j 列的所有行。

    python 复制代码
    column = data.iloc[:, 1]  # 选择第2列的所有行
  4. 选择多个行和列

    使用 data.iloc[i:m, j:n] 来选择从第 i 行到第 m 行,第 j 列到第 n 列的数据。

    python 复制代码
    sub_data = data.iloc[0:3, 1:4]  # 选择第1行到第3行,第2列到第4列的数据
  5. 使用切片
    iloc 也支持 Python 的切片语法,可以用于选择行或列的范围。

    python 复制代码
    sub_data_rows = data.iloc[0:5:2, :]  # 选择第1行到第5行,步长为2的行
    sub_data_cols = data.iloc[:, 1:5:2]  # 选择第2列到第5列,步长为2的列
  6. 选择多个不连续的行或列

    使用数组或列表来选择多个不连续的行或列。

    python 复制代码
    selected_rows = data.iloc[[0, 2, 4], :]  # 选择第1、3、5行的所有列
    selected_cols = data.iloc[:, [1, 3]]     # 选择第2、4列的所有行

请注意,在使用 iloc 时,索引是从0开始的,即第一行或第一列的索引是0。此外,iloc 只能用于选择行和列,不能用于选择 DataFrame 中的标签(即列名或索引)。如果你需要基于标签选择数据,应该使用 loc 而不是 iloc

在数据分析代码中的应用

这是在一个数据分析代码中的一部分,这里就用了iloc[]选取前两列作为特征数据,第三列作为目标变量(也就是通过前两列的值预测最后一列的数据)。

python 复制代码
# 1. 数据加载
data = pd.read_csv('data.csv')
X = data.iloc[:, :2]  # 取前两列作为特征
y = data.iloc[:, 2]  # 取第三列作为目标变量

# 2. 数据预处理
X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.2, random_state=42)
scaler = StandardScaler()
X_train_scaled = scaler.fit_transform(X_train)
X_test_scaled = scaler.transform(X_test)
相关推荐
YF云飞15 分钟前
数据仓库进化:Agent驱动数智化新范式
数据仓库·人工智能·ai
ningmengjing_31 分钟前
理解损失函数:机器学习的指南针与裁判
人工智能·深度学习·机器学习
程序猿炎义1 小时前
【NVIDIA AIQ】自定义函数实践
人工智能·python·学习
小陈phd1 小时前
高级RAG策略学习(四)——上下文窗口增强检索RAG
人工智能·学习·langchain
居然JuRan1 小时前
阿里云多模态大模型岗三面面经
人工智能
THMAIL1 小时前
深度学习从入门到精通 - BERT与预训练模型:NLP领域的核弹级技术详解
人工智能·python·深度学习·自然语言处理·性能优化·bert
nju_spy1 小时前
Kaggle - LLM Science Exam 大模型做科学选择题
人工智能·机器学习·大模型·rag·南京大学·gpu分布计算·wikipedia 维基百科
中國龍在廣州2 小时前
GPT-5冷酷操盘,游戏狼人杀一战封神!七大LLM狂飙演技,人类玩家看完沉默
人工智能·gpt·深度学习·机器学习·计算机视觉·机器人
东哥说-MES|从入门到精通2 小时前
Mazak MTF 2025制造未来参观总结
大数据·网络·人工智能·制造·智能制造·数字化
CodeCraft Studio2 小时前
Aspose.Words for .NET 25.7:支持自建大语言模型(LLM),实现更安全灵活的AI文档处理功能
人工智能·ai·语言模型·llm·.net·智能文档处理·aspose.word