推广 热搜： 京东联通 iphone11 摄像头 iPhone 企业存储 XSKY 京东智能采购网络安全自动驾驶

首页 > 资讯 > 云计算

总结了Pandas实现数据清洗的7种方式

日期：2021-05-08 来源：python数据分析之禅作者：itcg 浏览：486 我要评论

导读：最近在做“对比excel，学习pandas系列”，前面发了一篇很受读者喜爱，今天给大家介绍一下excel和pandas实现数据清

最近在做“对比excel，学习pandas系列”，前面发了一篇很受读者喜爱，今天给大家介绍一下excel和pandas实现数据清洗的种方式

政府采购

1.处理数据中的空值

我们在处理真实的数据时，往往会有很多缺少的的特征数据，就是所谓的空值，必须要进行处理才能进行下一步分析

空值的处理方式有很多种，一般是删除或者填充

Excel通过“查找和替换”功能实现空值的统一替换：

政府采购

通过“定位”删除空值：

政府采购

pandas处理空值的方式比较灵活，可以使用dropna函数删除空值

import pandas as pd data=pd.read_csv('成绩表.csv',encoding='gbk') data.dropna(how='any')

政府采购

用fillna函数实现空值的填充

①使用数字0填充数据表中的空值

data.fillna(value=0)

政府采购

②使用平均值填充数据表中的空值

data['语文'].fillna(data['语文'].mean())

政府采购

2.删除空格

excel中清理空格很简单，直接替换即可

pandas删除空格也很方便，主要使用map函数

data['姓名']=data['姓名'].map(str.strip) data

政府采购

3.大小写转换

excel中大小写转换函数分别为upper()和lower()

pandas中转换函数也为upper()和lower()

data['拼音']=data['拼音'].str.upper() data

政府采购

data['拼音']=data['拼音'].str.lower() data

政府采购

4.更改数据格式

excel中更改数据格式通过快捷键“ctrl+1”打开“设置单元格格式”：

政府采购

pandas使用astype来修改数据格式，以将“语文”列改成整数为例

data['语文'].dropna(how='any').astype('int')

政府采购

5.更改列名称

excel中更改列名称就不说了，大家都会

pandas使用rename函数更改列名称，代码如下：

data.rename(columns={'语文':'语文成绩'})

政府采购

6.删除重复值

excel的功能区“数据”下有“删除重复项”，可以用来删除表中的重复值，默认保留最第一个重复值，把后面的删除：

政府采购

pandas使用drop_duplicates函数删除重复值：

data['数学'].drop_duplicates() #默认删除后面的重复值 data['数学'].drop_duplicates(keep='last') #删除第一项重复值 7.修改及替换数据

excel中使用“查找和替换”功能实现数值的替换

pandas中使用replace函数实现数据替换

data['姓名'].replace('成功','失败')

数据清洗方式

点赞 0反对 0举报 0 收藏 0 打赏 0评论 0

更多>同类资讯

0 条相关评论

头条阅读

推荐图文

西部数据推出 26TB 3.5 英寸硬盘，为创意专业人士和内容创作者增加容量	麒麟9006C：华为5纳米家族的新成员
中国大陆显示器线上市场：2023年11月销售火爆，创下新高	高通骁龙X Elite芯片挑战苹果M系列：硬件性能对决

相关资讯

• 《怪物猎人荒野》篡改数据后果严重，卡普空最高	• Zesty 推出 Pod 规模优化解决方案，为 Kubernet
• 《少女前线》Steam版5月20日上线，4月21日起可	• NetApp 与 Google Cloud 合作，简化在云中扩展
• 奥兰德 20-200kVA 三相 UPS 新品重磅出击	• 打造一站式 IT 解决方案，联想企业购助力中小企
• 西部数据推出 26TB 3.5 英寸硬盘，为创意专业人	• 多维升级，助推 AI 部署！山特城堡 G7 机架式
• “模”力无界，“算”赋百业！奥兰德 MDC 智能	• 伊顿电子元器件，满足高算力数据中心设备新需求