用Python實現數據的透視表的方法

2024-09-09 19:02:25

字體：大中小

來源：轉載

供稿：網友

在處理數據時，經常需要對數據分組計算均值或者計數，在Microsoft Excel中，可以通過透視表輕易實現簡單的分組運算。而對于更加復雜的分組運算，Python中pandas包可以幫助我們實現。

1 數據

首先引入幾個重要的包：

import pandas as pdimport numpy as npfrom pandas import DataFrame,Series

通過代碼構造數據集：

data=DataFrame({'key1':['a','b','c','a','c','a','b','a','c','a','b','c'],'key2':['one','two','three','two','one','one','three','one','two','three','one','two'],'num1':np.random.rand(12),'num2':np.random.randn(12)})

得到數據集如下：

data key1 key2  num1  num20 a one 0.268705 0.0840911 b two 0.876707 0.2177942 c three 0.229999 0.5744023 a two 0.707990 -1.4444154 c one 0.786064 0.3432445 a one 0.587273 1.2123916 b three 0.927396 1.5053727 a one 0.295271 -0.4976338 c two 0.292721 0.0988149 a three 0.369788 -1.157426

2 交叉表―分類計數

按照不同類進行計數統計是最常見透視功能，可以通

（1）crosstab

#函數：crosstab(index, columns, values=None, rownames=None, colnames=None, aggfunc=None, margins=False, dropna=True, normalize=False)

crosstab的index和columns是必須要指定復制的參數：

pd.crosstab(data.key1,data.key2)

結果如下：

key2 one three twokey1     a  3  1 1b  0  1 1c  1  1 1

想要在邊框處增加匯總項可以指定margin的值為True：

pd.crosstab(data.key1,data.key2,margins=True)

結果：

key2 one three two Allkey1      a  3  1 1 5b  1  1 1 3c  1  1 2 4All  5  3 4 12

（2）pivot_table

函數：

pivot_table(data, values=None, index=None, columns=None, aggfunc='mean', fill_value=None, margins=False, dropna=True, margins_name='All')

使用pivot_table函數同樣可以實現，運算函數默認值aggfunc='mean',指定為aggfunc='count'即可：

data.pivot_table('num1',index='key1',columns='key2',aggfunc='count')

結果相同：

key2 one three twokey1     a  3  1 1b  1  1 1c  1  1 2

（3）groupby

通過groupby相對來說會更加復雜，首先需要對data按照key1和key2進行聚類，然后進行count運算，再將key2的index重塑為columns：

data.groupby(['key1','key2'])['num1'].count().unstack()

結果：

key2 one three twokey1     a  3  1 1b  1  1 1c  1  1 2

3 其它透視表運算

（1）pivot_table

pivot_table(data, values=None, index=None, columns=None, aggfunc='mean', fill_value=None, margins=False, dropna=True, margins_name='All')

要進行何種運算，只需要指定aggfunc即可。

默認計算均值：

data.pivot_table(index='key1',columns='key2')

out：

上一篇：python里dict變成list實例方法

下一篇：python實現的多任務版udp聊天器功能案例

學習交流

如何查找有故障的配件

如何查找有故障的配件...

熱門圖片

猜你喜歡的新聞

猜你喜歡的關注

新聞熱點

最牛同桌！我考了696分我同桌考了703分

2024-06-26 22:28:41

650分！高二女生考入北大：遺憾不能上高三

2024-06-26 22:26:16

男生估分600只考了397 媽媽：高考雖重要，但不代表所有

2024-06-26 22:23:01

唐尚珺回應是否會直播帶貨：有人出100萬想和他合作！

2024-06-25 19:29:23

名校搶人名場面：清華、北大太拼了！

2024-06-25 19:22:14

男生高考語文滿分！網友：第一次聽說

2024-06-25 19:19:15

疑難解答

圖片精選

網友關注