Pandas实战100例 | 案例 22: 分组运算

案例 22: 分组运算

知识点讲解

Pandas 的 groupby 方法允许你对数据进行分组,并对每个分组应用聚合函数,如求和、求平均、求最大值等。这对于分类数据的分析非常重要。

  • 分组后求和 : groupby 后使用 sum 方法可以对每个分组的数值求和。
  • 分组后求平均 : groupby 后使用 mean 方法可以计算每个分组的平均值。
  • 分组后求最大值 : groupby 后使用 max 方法可以找到每个分组的最大值。
示例代码
python 复制代码
# 准备数据和示例代码的运行结果,用于案例 22

# 示例数据
data_grouped_operations = {
    'Category': ['A', 'B', 'A', 'B', 'C', 'C', 'C'],
    'Values': [10, 15, 20, 25, 5, 10, 15]
}
df_grouped_operations = pd.DataFrame(data_grouped_operations)

# 分组运算
grouped_sum = df_grouped_operations.groupby('Category').sum()
grouped_mean = df_grouped_operations.groupby('Category').mean()
grouped_max = df_grouped_operations.groupby('Category').max()

df_grouped_operations, grouped_sum, grouped_mean, grouped_max

在这个示例中,我们首先根据 Category 列对 DataFrame 进行分组。然后,我们对每个分组计算了总和、平均值和最大值。

示例代码运行结果

原始 DataFrame (df_grouped_operations):

复制代码
  Category  Values
0        A      10
1        B      15
2        A      20
3        B      25
4        C       5
5        C      10
6        C      15

分组后的求和 (grouped_sum):

复制代码
          Values
Category        
A             30
B             40
C             30

分组后的平均值 (grouped_mean):

复制代码
          Values
Category        
A           15.0
B           20.0
C           10.0

分组后的最大值 (grouped_max):

复制代码
          Values
Category        
A             20
B             25
C             15

这个案例说明了如何对分类数据进行有效的分组和聚合运算,这对于理解数据集中的不同类别是非常有用的。

相关推荐
Agentic AI人工智能与大数据4 小时前
数据产品运营指南:如何提升用户活跃度?这4个策略让数据产品不再“沉睡”
大数据·ai·产品运营
飞Link5 小时前
开发者必读:2026 欧盟“AI Omnibus”法案达成,技术合规性红线在哪里?
大数据
老纪的技术唠嗑局5 小时前
深度解析 LLM Wiki / Obsidian-Wiki / GBrain:Agent 时代知识的“自组织”与“自进化”
大数据·数据库·人工智能·算法
好赞科技7 小时前
2026年高口碑餐厅预约小程序排行榜:智能就餐新体验一键解锁
大数据·微信小程序
数据智能老司机7 小时前
深入解锁 dbt——Documentation:项目文档与数据文档
大数据
计算机毕业编程指导师7 小时前
【计算机毕设推荐】Python+Hadoop+Spark共享单车数据可视化分析系统 毕业设计 选题推荐 毕设选题 数据分析 机器学习 数据挖掘
大数据·hadoop·python·计算机·数据挖掘·spark·课程设计
计算机毕业编程指导师7 小时前
【计算机毕设】基于Hadoop的共享单车订单数据分析系统+Python+Django全栈开发 毕业设计 选题推荐 毕设选题 数据分析 机器学习 数据挖掘
大数据·hadoop·python·计算机·数据挖掘·spark·django
2601_956139428 小时前
文体娱媒品牌全案公司哪家强
大数据·人工智能·python
塔望品牌咨询8 小时前
组织效率诊断框架:返工、解释、等待、救火,分别说明了什么
大数据·产品运营
塔能物联运维8 小时前
两相液冷:从“散热”到“控温”,重构高密度算力的热管理系统
大数据·人工智能