您的位置:首页 > 运维架构

Pandas之drop_duplicates:去除重复项

2017-11-17 11:15 330 查看

方法

DataFrame.drop_duplicates(subset=None, keep='first', inplace=False)


参数

这个drop_duplicate方法是对DataFrame格式的数据,去除特定列下面的重复行。返回DataFrame格式的数据。

subset : column label or sequence of labels, optional

用来指定特定的列,默认所有列

keep : {‘first’, ‘last’, False}, default ‘first’

删除重复项并保留第一次出现的项

inplace : boolean, default False

是直接在原来数据上修改还是保留一个副本

实验

内容来自用户分享和网络整理,不保证内容的准确性,如有侵权内容,可联系管理员处理 点击这里给我发消息
标签:  pandas numpy