Python数据分析(空值、重复值检测删除与设置)

打开Anaconda PowerShell

cd 进入指定该文件下,输入jupyter notebook,就能在该目录下打开

python 复制代码
import numpy as np
import pandas as pd
df_obj = pd.DataFrame({"类别":["小说", "散文随笔", "青春文学","传记"],
                   "书名":[np.nan, "《皮囊》", "《旅程结束时》", "《老舍自传》"],
                    "作者":["老舍", None, "张其鑫", "老舍"]})
import pandas as pd
df=pd.read_excel('线上课程-综合测试1-MG公司2019年销售数据试题.xlsx')
df

空值检测

python 复制代码
df['成本'].isnull().value_counts()# 成本这一列是空的True与False数量统计

df['成本'].isnull().any()# 成本这列是否存在空值

重复检测


python 复制代码
df.dropna(subset='收入类别',inplace=True) # subset检查"区域"这列的重复值情况
df
相关推荐
消失的旧时光-19431 小时前
C++ 多线程与并发系统取向(五)—— std::atomic:原子操作与状态一致性(类比 Java Atomic)
开发语言·jvm·c++·并发
资深web全栈开发1 小时前
CoI - 组合优于继承:解耦的艺术
android·java·开发语言
低频电磁之道1 小时前
C++中预定义宏
开发语言·c++
工程师0071 小时前
MQTT 概念详解与 C# 实战
开发语言·c#·mqtt通信
代码改善世界2 小时前
栈和队列的实现与详解(C语言版):从底层原理到代码实战
c语言·开发语言
家的尚尚签2 小时前
高定木作企业实践:案例分享与成果展示
大数据·人工智能·python
无名之逆3 小时前
你可能不需要WebSocket-服务器发送事件的简单力量
java·开发语言·前端·后端·计算机·rust·编程
Remember_9933 小时前
一文吃透Java WebSocket:原理、实现与核心特性解析
java·开发语言·网络·websocket·网络协议·http·p2p
锅包一切3 小时前
一、C++ 发展与程序创建
开发语言·c++·后端·学习·编程