pandas 是 Python Data Analysis Library 的缩写,是基于Numpy的一种工具,该工具是为了解决数据分析任务而创建的。
numpy是用来处理数值型数据的,pandas是用来处理除了数值型数据的其他数据的
最重要的就是DataFrame(数据表格,excel,二维:行,列
series(一维)
DataFrame
DataFrame属性:value,columns,index,shape
第一种创建方法
from pandas import DataFrame import numpy as np df = DataFrame(data={ "Python":np.random.randint(0,150,size=5), "Math":np.random.randint(0,150,size=5), "English":np.random.randint(0,150,size=5), }) print(df)
结果:
Python Math English
0 10 5 66
1 135 121 121
2 116 97 23
3 147 76 104
4 35 32 84
我们给他加上索引
from pandas import DataFrame import numpy as np df = DataFrame(data={ "Python":np.random.randint(0,150,size=5), "Math":np.random.randint(0,150,size=5), "English":np.random.randint(0,150,size=5), },index=list("ABCDE")) print(df)
结果:
Python Math English A 111 144 9 B 1 97 55 C 46 92 11 D 134 16 112 E 31 66 4
第二种方法
from pandas import DataFrame import numpy as np df = DataFrame(data=np.random.randint(0,150,size=(10,4)),#size代表的是10行4列 index=list("ABCDE12345"), columns=["python",'math','en','physic']) print(df)
结果:
python math en physic A 63 79 8 30 B 146 29 45 36 C 45 99 9 54 D 104 127 122 68 E 76 113 89 97 1 56 73 25 118 2 5 46 134 126 3 29 84 47 94 4 36 112 1 8 5 35 6 48 3
dataframe的保存
dataframe可以保存成很多类型的文件,to_csv,to_dict,to_json,to_excel等等
from pandas import DataFrame import numpy as np df = DataFrame(data=np.random.randint(0,150,size=(10,4)),#size代表的是10行4列 index=list("ABCDE12345"), columns=["python",'math','en','physic']) print(df.to_dict())
结果:
{'python': {'A': 95, 'B': 99, 'C': 146, 'D': 109, 'E': 147, '1': 56, '2': 16, '3': 115, '4': 137, '5': 110}, 'math': {'A': 70, 'B': 72, 'C': 96, 'D': 54, 'E': 32, '1': 147, '2': 39, '3': 110, '4': 23, '5': 25}, 'en': {'A': 49, 'B': 117, 'C': 14, 'D': 25, 'E': 65, '1': 125, '2': 86, '3': 99, '4': 143, '5': 3}, 'physic': {'A': 25, 'B': 22, 'C': 95, 'D': 112, 'E': 108, '1': 83, '2': 131, '3': 75, '4': 135, '5': 0}}
浙公网安备 33010602011771号