Python使用pandas库,其中的DataFrame可以看作是一个二维的、大小可变的、有潜在异构类型列的表格型数据结构

Python的pandas库是一个非常强大的数据处理工具,其中的DataFrame对象更是其核心组件。DataFrame可以看作是一个二维的、大小可变的、有潜在异构类型列的表格型数据结构。你可以把它想象成一个Excel表格,有行有列,可以存储各种类型的数据。

下面是一些常见的pandas DataFrame对象处理操作:

  1. 创建DataFrame

python

复制

import pandas as pd

使用字典创建DataFrame

data = {'Name': 'Tom', 'Nick', 'John', 'Age': 20, 21, 19}

df = pd.DataFrame(data)

打印DataFrame

print(df)

  1. 查看DataFrame的基本信息

python

复制

查看前几行数据

print(df.head())

查看后几行数据

print(df.tail())

查看数据的基本信息,包括每列的非空值数量、类型等

print(df.info())

查看数据的摘要统计

print(df.describe())

  1. 选择数据

python

复制

选择单列

print(df'Name')

选择多列

print(df\['Name', 'Age'])

使用iloc根据整数位置选择行和列

print(df.iloc0:2, 0:1) # 选择前两行,第一列

使用loc根据标签选择行和列

print(df.loc0:2, 'Name') # 选择前两行,'Name'列

  1. 数据清洗

python

复制

删除含有缺失值的行

df_dropna = df.dropna()

填充缺失值

df_fillna = df.fillna(method='ffill') # 前向填充

  1. 数据排序

python

复制

按照某列进行排序

df_sorted = df.sort_values(by='Age')

  1. 数据分组和聚合

python

复制

按照某列进行分组,并对另一列进行聚合操作(如求和)

df_grouped = df.groupby('Name')'Age'.sum()

  1. 数据合并

python

复制

创建另一个DataFrame

df2 = pd.DataFrame({'Name': 'Tom', 'Jerry', 'Score': 90, 85})

按照'Name'列进行合并

df_merged = pd.merge(df, df2, on='Name')

这些只是pandas DataFrame对象处理的一些基本操作,pandas库的功能远不止于此。如果你需要处理更复杂的数据,建议查阅pandas的官方文档或相关教程。

相关推荐
爱读源码的大都督12 分钟前
DeepSeek面试官问:生产RAG系统回答不准确,该如何定位和优化?这样回答,能让面试官当场给你Offer!
java·后端·python
“AI国潮设计-小江”29 分钟前
【Python实战】SDXL精准控制“普宁英歌舞×星空蛋糕”IP落地,附核心Prompt与商用授权思路
开发语言·人工智能·python·prompt·aigc
k4m7v2pz33 分钟前
从 Python 搬到 Rust:pyglet MIDI DAW 变成 egui 鬼畜采样器的迁移复盘
开发语言·python·rust
tryCbest1 小时前
FastAPI中passlib包的作用
python·fastapi·passlib
心中有你02141 小时前
Python Tkinter 情侣恋爱日记桌面小程序(本地文件存储,无数据库)
开发语言·python
PFFstronger1 小时前
从 0 到 1 搭建接口自动化测试框架:分层架构 + 数据驱动 + 接口依赖编排
python·架构·自动化
Andya_net1 小时前
Spring Boot | 条件注解完全指南:从 @Conditional 到 @ConditionalOnExpression 的原理、实践与避坑
spring boot·后端·python
weixin_440730501 小时前
playwright浏览器自动化实战笔记3-登陆以及退出登陆流程-多用户操作
笔记·python·自动化
卷无止境2 小时前
测试全绿,功能能跑,代码却烂到没法上线:AI编程助手留下的十个坑
后端·python
卷无止境2 小时前
终端里的AI战争,命令行编程代理全景扫描
python·agent