Python对多属性的重复数据去重实例-创新互联

python中的pandas模块中对重复数据去重步骤：

创新互联2013年至今，公司自成立以来始终致力于为企业提供官网建设、移动互联网业务开发（小程序设计、手机网站建设、重庆APP开发等），并且包含互联网基础服务（域名、主机服务、企业邮箱、网络营销等）应用服务；以先进完善的建站体系及不断开拓创新的精神理念，帮助企业客户实现互联网业务，严格把控项目进度与质量监控加上过硬的技术实力获得客户的一致赞誉。

1）利用DataFrame中的duplicated方法返回一个布尔型的Series,显示各行是否有重复行，没有重复行显示为FALSE，有重复行显示为TRUE；

2）再利用DataFrame中的drop_duplicates方法用于返回一个移除了重复行的DataFrame。

注释：

如果duplicated方法和drop_duplicates方法中没有设置参数，则这两个方法默认会判断全部咧，如果在这两个方法中加入了指定的属性名（或者称为列名），例如：frame.drop_duplicates(['state']),则指定部分列（state列）进行重复项的判断。

具体实例如下：

>>> import pandas as pd 
>>> data={'state':[1,1,2,2],'pop':['a','b','c','d']} 
>>> frame=pd.DataFrame(data) 
>>> frame 
 pop state 
0 a  1 
1 b  1 
2 c  2 
3 d  2 
>>> IsDuplicated=frame.duplicated() 
>>> print IsDuplicated 
0 False 
1 False 
2 False 
3 False 
dtype: bool 
>>> frame=frame.drop_duplicates(['state']) 
>>> frame 
 pop state 
0 a  1 
2 c  2 
>>> IsDuplicated=frame.duplicated(['state']) 
>>> print IsDuplicated 
0 False 
2 False 
dtype: bool 
>>>

名称栏目：Python对多属性的重复数据去重实例-创新互联
URL分享：http://chengdu.cdxwcx.cn/article/ehogh.html

甜橘子，专注成都网站制作网站设计与营销型网站建设与优化

首页

网站建设

网站制作案例

解决方案

网站设计报价

网站制作动态

关于我们

联系我们

成都网站建设设计将想法与焦点和您一起共享

Python对多属性的重复数据去重实例-创新互联

其他资讯

跟我学SpringCloud（Finchley版）-02-构建分布式应用

C#怎么读取Txt大数据并更新到数据库

C语言如何实现单词助手功能

HTML5网页水印SDK的实现方法是什么

css如何实现垂直导航栏

甜橘子，专注成都网站制作网站设计与营销型网站建设与优化

成都网站建设设计 将想法与焦点和您一起共享

Python对多属性的重复数据去重实例-创新互联

其他资讯

跟我学SpringCloud（Finchley版）-02-构建分布式应用

C#怎么读取Txt大数据并更新到数据库

C语言如何实现单词助手功能

HTML5网页水印SDK的实现方法是什么

css如何实现垂直导航栏

成都网站建设设计将想法与焦点和您一起共享