[英]pandas percent of group by two columns
我正在尋找一種解決方案來獲得類似“colA 的結果百分比”列的結果。 例如,該值表示 1 月 (colA) 月貓 (colB) 與 1 月貓和狗的百分比。
import pandas as pd
# set up dataframe
df_ex = pd.DataFrame({'colA':['2021-01-31', '2021-01-31', '2021-01-31', '2021-02-28',
'2021-02-28', '2021-02-28', '2021-03-31', '2021-03-31'],
'colB':['cat', 'cat', 'dog', 'cat', 'dog', 'cat', 'cat', 'dog'],
'colC':[1,2,3,4,4,5,6,7], })
df_ex = df_ex.groupby(['colA', 'colB']).sum()
df_ex = df_ex.reset_index()
df_ex['result percent of colA'] = [0.5, 0.5, 0.69, 0.31, 0.46, 0.54] #expecte result
感謝幫助!
您可以將列除以每個colA
的colC
總和,其大小與使用GroupBy.transform
的原始大小相同:
df_ex['perc'] = df_ex['colC'].div(df_ex.groupby('colA')['colC'].transform('sum')).round(2)
print (df_ex)
colA colB colC perc
0 2021-01-31 cat 3 0.50
1 2021-01-31 dog 3 0.50
2 2021-02-28 cat 9 0.69
3 2021-02-28 dog 4 0.31
4 2021-03-31 cat 6 0.46
5 2021-03-31 dog 7 0.54
詳情:
print (df_ex.groupby('colA')['colC'].transform('sum'))
0 6
1 6
2 13
3 13
4 13
5 13
Name: colC, dtype: int64
聲明:本站的技術帖子網頁,遵循CC BY-SA 4.0協議,如果您需要轉載,請注明本站網址或者原文地址。任何問題請咨詢:yoyou2525@163.com.