05 2021 档案

摘要:drop_duplicates有两种用法 1.完全除去重复的行数据,不需要定义任何参数 2.去除重复的几列行数据 以上是drop_duplicates的参数含义 subset:指定重复数据所在列 keep:(1)first:去除重复列后第一次出现的行数据;(2)last:去除重复列后最后一次出现的行 阅读全文
posted @ 2021-05-09 11:34 alian_c 阅读(3784) 评论(0) 推荐(0)
摘要:1.查看数据缺失值数量 df=pd.read_csv(r'') print(df.isnull().sum().sort_values()) 2.条件筛选替换新值 df.loc[条件1,'替换列']=替换值 df[替换列]=df[替换列].replace(旧值,新值) 3.删除缺失值 df.fill 阅读全文
posted @ 2021-05-05 16:18 alian_c 阅读(103) 评论(0) 推荐(0)