Pandas库介绍、Series数据类型
Pandas库介绍
Pandas是Python的第三方库,提供高性能易用数据类型和分析工具。
- 提供适合分析的数据类型
- 提供分析数据的函数
pandas是基于numpy实现的
import pandas as pd
d = pd.Series(range(20))
print(d)
d.cumsum()#计算前n项的累加和
"""输出结果
0 0
1 1
2 2
3 3
4 4
5 5
6 6
7 7
8 8
9 9
10 10
11 11
12 12
13 13
14 14
15 15
16 16
17 17
18 18
19 19
dtype: int64
"""
两个数据类型:Series(一维),DataFrame(多维)
| NUMPY | PANDAS |
|---|---|
| 基础数据类型 | 扩展数据类型 |
| 关注数据的结构表达 | 关注数据的应用表达 |
| 维度:数据间的关系 | 数据与索引间的关系 |
Series数据类型
series数据类型是由一组数据及其索引构成
a = pd.Series([9,8,7,6])
"""输出
0 9
1 8
2 7
3 6
dtype: int64
"""
a = pd.Series([9,8,7,6],index=['a','b','c','d'])
"""
a
Out[14]:
a 9
b 8
c 7
d 6
dtype: int64
"""
可以看出,使用pandas处理数据,每一个数据都要有一个索引与之对应。
import pandas as pd
s = pd.Series(25,index=('a','b','c'))#使用标量创建一个series类型
d = pd.Series({'a':9,'b':8,'c':7})#直接将字典变成一个series数据类型
e = pd.Series({'a':9,'b':8,'c':7},index=['c','a','b','d'])
#由index在字典中挑选相关的值,构造一个series类型
pandas的index跟numpy的array结合到一起,就算series

浙公网安备 33010602011771号