关于一些pandas和numpy还有一些库函数的小结(持续更新)
1.关于sum函数:sum(-1)、sum(1)、sum(0):
功能: 求行列之和
参数: axis:需要排序的维度
返回值: 输出计算后的数组
2.np.argsort(a):
功能: 将矩阵a按照axis从小到大排序,并返回排序后的下标
参数: a:输入矩阵, axis:需要排序的维度
返回值: 输出排序后的下标
3.pandas模块轴旋转函数stack和unstack用法:
功能: stack将pandas数据的列索引旋转为行索引,unstack将pandas数据行索引旋转位列索引
参数: level
返回值: 返回改变后的格式
4.numpy与pandas中isnull()、notnull()、dropna()、fillna()处理丢失数据:
isnull():是空值返回true,否则返回false
notnull():是空值返回false,否则返回true
dropna():默认干掉有空值的行
fillna():填充空值
对元素进行排序
value_counts(normalize=False, sort=True, ascending=False, bins=None, dropna=True)
参数:
1.normalize : boolean, default False 默认false,如为true,则以百分比的形式显示
2.sort : boolean, default True 默认为true,会对结果进行排序
3.ascending : boolean, default False 默认降序排序
4.bins : integer, 格式(bins=1),意义不是执行计算,而是把它们分成半开放的数据集合,只适用于数字数据
5.dropna : boolean, default True 默认删除na值
pivot_table有四个最重要的参数index、values、columns、aggfunc

浙公网安备 33010602011771号