簡體   English   中英

與seaborn分組的箱線圖

[英]Grouped boxplot with seaborn

我在python panda DataFrame中有以下數據。 我想將類似於https://stanford.edu/~mwaskom/software/seaborn/examples/grouped_boxplot.html中的方框圖

對於每個id,我想並排繪制兩個箱形圖。 我該如何做到這一點。 我嘗試用seaborn軟件包進行繪圖,但沒有成功。

id               predicted                              real
1            [10, 10, 10]                      [16, 18, 20]   
2            [12, 12, 15]              [15, 17, 19, 21, 23]
3           [20, 5, 4, 4]                          [29, 32]
4    [25, 25, 25, 24, 21]  [21, 24, 25, 26, 28, 29, 30, 33]
5        [20, 20, 20, 21]  [21, 22, 24, 26, 28, 30, 31, 32]
6           [8, 3, 3, 14]                          [25, 27]
7  [1, 4, 4, 4, 5, 6, 10]                      [69, 71, 72]
8        [11, 11, 11, 11]              [19, 21, 22, 23, 24]
9            [7, 6, 9, 9]                  [19, 26, 27, 28]
10    [30, 30, 30, 30, 30]                          [38, 39]

注意您正在查看的示例中的表結構

import seaborn as sns

tips = sns.load_dataset("tips")
sns.boxplot(x="day", y="total_bill", hue="sex", data=tips, palette="PRGn")
sns.despine(offset=10, trim=True)

在此處輸入圖片說明

tips.head()

在此處輸入圖片說明


我們的目標是像這樣設置您的桌子

設定

from StringIO import StringIO
import pandas as pd

text = """id               predicted                              real
1            [10, 10, 10]                      [16, 18, 20]   
2            [12, 12, 15]              [15, 17, 19, 21, 23]
3           [20, 5, 4, 4]                          [29, 32]
4    [25, 25, 25, 24, 21]  [21, 24, 25, 26, 28, 29, 30, 33]
5        [20, 20, 20, 21]  [21, 22, 24, 26, 28, 30, 31, 32]
6           [8, 3, 3, 14]                          [25, 27]
7  [1, 4, 4, 4, 5, 6, 10]                      [69, 71, 72]
8        [11, 11, 11, 11]              [19, 21, 22, 23, 24]
9            [7, 6, 9, 9]                  [19, 26, 27, 28]
10    [30, 30, 30, 30, 30]                          [38, 39]"""

df = pd.read_csv(StringIO(text), sep='\s{2,}', engine='python', index_col=0)

df = df.stack().str.strip('[]') \
       .str.split(', ').unstack()
df

在此處輸入圖片說明


以正確的格式獲取表格

df1 = df.stack().apply(pd.Series).stack().astype(int) \
          .rename_axis(['id', 'reality', None]) \
          .rename('value').reset_index(['id', 'reality']) \
          .reset_index(drop=True)

df1.head()

在此處輸入圖片說明

sns.boxplot(x='id', y='value', hue='reality', data=df1, palette='PRGn')
sns.despine(offset=10, trim=True)

在此處輸入圖片說明

暫無
暫無

聲明:本站的技術帖子網頁,遵循CC BY-SA 4.0協議,如果您需要轉載,請注明本站網址或者原文地址。任何問題請咨詢:yoyou2525@163.com.

 
粵ICP備18138465號  © 2020-2024 STACKOOM.COM