python文件去重函数 python去重和排序( 二 ) _方法

网上看了一下大家的教程，大部分都是教去除重复行，很少有说到仅保留重复行的。所以在这里用drop_duplicates这个去重函数来实现这个功能。
drop_duplicates函数介绍：
data.drop_duplicates(subset=[‘A’,‘B’],keep=‘first’,inplace=True)
#subset对应的值是列名，表示只考虑这两列，将这两列对应值相同的行进行去重。
默认值为subset=None表示考虑所有列。
keep='first’表示保留第一次出现的重复行，是默认值。
keep另外两个取值为"last"和False，分别表示保留最后一次出现的重复行和去除所有重复行。
inplace=True表示直接在原来的DataFrame上删除重复项，而默认值False表示生成一个副本。
要用函数取得数据集data中的重复列，分三个步骤：
（提前导入pandas模块）
data0_1 = data.drop_duplicates() #保留第一个重复行
data0_2 = data.drop_duplicates(keep=False) #去除所有重复行
data0_3=pd.concat([data0_1,data0_2]).drop_duplicates(keep=False)
#合并起来再去重，只剩下真的重复行。
举例：data中wangwu行和tony行重复，需要把它们两行取出。
第一步：#保留第一个重复行
第二步：#去除所有重复行
第三步：#合并起来再去重
通过以上步骤实现取出数据中的重复行。
【python文件去重函数 python去重和排序】python文件去重函数的介绍就聊到这里吧，感谢你花时间阅读本站内容，更多关于python去重和排序、python文件去重函数的信息别忘了在本站进行查找喔。

python文件去重函数 python去重和排序( 二 )

推荐阅读

苹果秋季发布会ar，我想问问苹果iPhone x发布会上ar摄像的恐龙怎么弄出来的

莱赛尔纤维被称为什么

上海迪士尼未满12岁要买成人票吗

现在的兄弟姐妹亲情都淡薄,有必要对兄弟姐妹的孩子好吗？

小圆贝怎么养才能活小圆贝怎么养

安慰坐牢的亲人的信如何安慰做牢的亲人，怎么安慰坐牢的家属

庆东锅炉补不上水故障怎么解决庆东锅炉不上水怎么办

脱发|脱发是缺少维生素B7？具体表现对应不同的B族维生素，试着看看

pg库怎么修改数据库，pg数据库修改用户密码

看海外的app，我想看外国官方网

水芹菜是发物吗

东京奥运会代表团出场顺序东京奥运会国家出场顺序名单

旋叶姬星美人怎么扦插

张伟丽在ufc什么量级 ufc张伟丽属于什么量

女生节礼物女生节礼物图片

傅崇碧怎么读傅崇碧名字打分105分

c语言定义一个分段函数如何用c语言编程分段函数

属虎女孩最吉利的名字免费有寓意的属虎女孩最吉利的名字

中信信用卡贷款怎么办理「建设银行贷款」

秋施基肥配方哪些好施用多少数量最好