Pandas 33个冷知识 0721

Pandas 33个冷知识

  1. 从Excel读取数据 : 使用 pd.read_excel('file.xlsx') 来读取Excel文件。

  2. 写入Excel : 使用 df.to_excel('file.xlsx', index=False) 将DataFrame写入Excel文件。

  3. 创建日期索引 : 使用 df.set_index(pd.to_datetime(df['date'])) 创建日期索引。

  4. 向后填充缺失值 : 使用 df.fillna(method='bfill') 向后填充缺失值。

  5. 按索引选取多行 : 使用 df.loc[[1, 2, 5]] 按索引选取多行。

  6. 按位置选取多行 : 使用 df.iloc[[0, 2, 4]] 按位置选取多行。

  7. 创建空Series : 使用 pd.Series(dtype='float64') 创建一个空Series。

  8. 重置列顺序 : 使用 df = df[['col2', 'col1']] 重新排列DataFrame的列顺序。

  9. 按多列排序 : 使用 df.sort_values(by=['col1', 'col2'], ascending=[True, False]) 按多列排序。

  10. 按列查找最大值的行 : 使用 df.loc[df['col'].idxmax()] 查找列中最大值所在的行。

  11. 按列查找最小值的行 : 使用 df.loc[df['col'].idxmin()] 查找列中最小值所在的行。

  12. 按条件删除行 : 使用 df.drop(df[df['col'] < 10].index) 按条件删除行。

  13. 按条件更新值 : 使用 df.loc[df['col'] < 10, 'col'] = 10 按条件更新值。

  14. 按列计算累计最大值 : 使用 df['cummax'] = df['col'].cummax() 计算列的累计最大值。

  15. 按列计算累计最小值 : 使用 df['cummin'] = df['col'].cummin() 计算列的累计最小值。

  16. 按列计算累计乘积 : 使用 df['cumprod'] = df['col'].cumprod() 计算列的累计乘积。

  17. 计算百分比变化 : 使用 df['pct_change'] = df['col'].pct_change() 计算列的百分比变化。

  18. 滚动窗口最大值 : 使用 df['rolling_max'] = df['col'].rolling(window=3).max() 计算滚动窗口最大值。

  19. 滚动窗口最小值 : 使用 df['rolling_min'] = df['col'].rolling(window=3).min() 计算滚动窗口最小值。

  20. 检测重复值 : 使用 df.duplicated() 检测重复值。

  21. 删除所有重复值 : 使用 df.drop_duplicates() 删除所有重复值。

  22. 替换值中的空字符串 : 使用 df.replace('', np.nan, inplace=True) 替换值中的空字符串。

  23. 数据透视表(多值) : 使用 pd.pivot_table(df, values=['val1', 'val2'], index='col1', columns='col2') 创建数据透视表。

  24. 分组并计算自定义函数 : 使用 df.groupby('col').apply(lambda x: x.max() - x.min()) 进行分组并计算自定义函数。

  25. 扩展列表到多行 : 使用 df.explode('col') 将列表扩展到多行。

  26. 按列计算频率表 : 使用 pd.crosstab(df['col1'], df['col2']) 计算频率表。

  27. 将列名改为小写 : 使用 df.columns = df.columns.str.lower() 将所有列名改为小写。

  28. 将列名改为大写 : 使用 df.columns = df.columns.str.upper() 将所有列名改为大写。

  29. 按列值绘制直方图 : 使用 df['col'].hist() 绘制列值的直方图。

  30. 按列值绘制密度图 : 使用 df['col'].plot(kind='kde') 绘制列值的密度图。

  31. 按列值绘制箱线图 : 使用 df.boxplot(column='col') 绘制列值的箱线图。

  32. 按列值绘制散点图 : 使用 df.plot.scatter(x='col1', y='col2') 绘制列值的散点图。

  33. 数据框列值字符串替换 : 使用 df['col'].str.replace('old', 'new') 替换列中的字符串。

相关推荐
多敲代码防脱发24 分钟前
Spring进阶(容器实现)
java·开发语言·后端·spring
m0_7020365328 分钟前
mysql如何通过索引减少行锁范围_mysql索引与加锁逻辑
jvm·数据库·python
用户03321266636731 分钟前
使用 Python 设置 Word 文档文本的颜色
python
qxwlcsdn34 分钟前
如何用 IndexedDB 存储从 API 获取的超大列表并实现二级索引
jvm·数据库·python
小新同学^O^38 分钟前
简单学习 --> 模型微调
开发语言·人工智能·python·模型微淘
水云桐程序员40 分钟前
C++变量的概念及用法
开发语言·c++
2301_809244531 小时前
C#怎么使用协变和逆变 C#泛型中的in和out关键字协变逆变是什么意思怎么用【语法】
jvm·数据库·python
知识汲取者1 小时前
巨量引擎营销 API 完整文档
开发语言·数据库·python
DevnullCoffe1 小时前
用 MCP 让 AI Agent 直接批量下载亚马逊商品图片——原理、踩坑与实现
爬虫·python·api
Larry_Yanan1 小时前
QML面试常见问题(一)QML中组件呈现方式的方法有哪些
开发语言·c++·qt·ui·面试