Pandas库介绍、Series数据类型

Pandas库介绍

Pandas是Python的第三方库,提供高性能易用数据类型和分析工具。

  1. 提供适合分析的数据类型
  2. 提供分析数据的函数

pandas是基于numpy实现的

import pandas as pd
d = pd.Series(range(20))
print(d)
d.cumsum()#计算前n项的累加和
"""输出结果
0      0
1      1
2      2
3      3
4      4
5      5
6      6
7      7
8      8
9      9
10    10
11    11
12    12
13    13
14    14
15    15
16    16
17    17
18    18
19    19
dtype: int64
"""

两个数据类型:Series(一维),DataFrame(多维)

NUMPY PANDAS
基础数据类型 扩展数据类型
关注数据的结构表达 关注数据的应用表达
维度:数据间的关系 数据与索引间的关系

Series数据类型

series数据类型是由一组数据及其索引构成

a = pd.Series([9,8,7,6])
"""输出
0    9
1    8
2    7
3    6
dtype: int64
"""
a = pd.Series([9,8,7,6],index=['a','b','c','d'])
"""
a
Out[14]: 
a    9
b    8
c    7
d    6
dtype: int64
"""

可以看出,使用pandas处理数据,每一个数据都要有一个索引与之对应。

import pandas as pd
s = pd.Series(25,index=('a','b','c'))#使用标量创建一个series类型
d = pd.Series({'a':9,'b':8,'c':7})#直接将字典变成一个series数据类型
e = pd.Series({'a':9,'b':8,'c':7},index=['c','a','b','d'])
#由index在字典中挑选相关的值,构造一个series类型

pandas的index跟numpy的array结合到一起,就算series

posted @ 2021-04-07 20:19  KONGQer  阅读(514)  评论(0)    收藏  举报