网上看了一下大家的教程,大部分都是教去除重复行,很少有说到仅保留重复行的 。所以在这里用drop_duplicates这个去重函数来实现这个功能 。
drop_duplicates函数介绍 :
data.drop_duplicates(subset=[‘A’,‘B’],keep=‘first’,inplace=True)
#subset对应的值是列名,表示只考虑这两列,将这两列对应值相同的行进行去重 。
默认值为subset=None表示考虑所有列 。
keep='first’表示保留第一次出现的重复行,是默认值 。
keep另外两个取值为"last"和False,分别表示保留最后一次出现的重复行和去除所有重复行 。
inplace=True表示直接在原来的DataFrame上删除重复项,而默认值False表示生成一个副本 。
要用函数取得数据集data中的重复列,分三个步骤 :
(提前导入pandas模块)
data0_1 = data.drop_duplicates() #保留第一个重复行
data0_2 = data.drop_duplicates(keep=False) #去除所有重复行
data0_3=pd.concat([data0_1,data0_2]).drop_duplicates(keep=False)
#合并起来再去重,只剩下真的重复行 。
举例:data中wangwu行和tony行重复,需要把它们两行取出 。
第一步:#保留第一个重复行
第二步:#去除所有重复行
第三步:#合并起来再去重
通过以上步骤实现取出数据中的重复行 。
【python文件去重函数 python去重和排序】python文件去重函数的介绍就聊到这里吧,感谢你花时间阅读本站内容,更多关于python去重和排序、python文件去重函数的信息别忘了在本站进行查找喔 。
- mongodb 更新子文档 mongodb数据文件无法新建
- mongodb存储文件如何存储 mongodb海量图片存储
- mongodb存储图片和文件实践 mongodb存文件和表
- mysql 输出格式 mysql输出到文件位置
- mongodb keyfile mongodb可执行文件路径怎么修改
- redis的ae.c文件 redis的ae.c
- mongodb数据库文件迁移 mongodb迁移到其他目录
- 将数据保存到文件中c语言 将数据保存到mongodb
- mysql账号密码配置文件 mysql账号和密码
- mysql怎么导出数据库文件 mysql写完如何导出
