簡體   English   中英

熊貓日期時間到整數索引

[英]Pandas datetime to integer index

假設我有以下數據框:

d = {'store': [a, a, a, b, b], 'date': [2020-1-30, 2020-1-30, 2020-2-28, 
2020-1-30, 2020-3-30], 'amount': [1, 2, 3, 5, 2]}
df = pd.DataFrame(data=d)
df
    store      date       amount
0     a     2020-1-30       1
1     a     2020-1-30       2
2     a     2020-2-28       3
3     b     2020-1-30       5
4     b     2020-3-30       2

我想要一列是一個遞增整數,它指定日期對應於特定商店的哪個時期,以及一個標記列,指出日期是否是最高日期,輸出如下:

    store      date       amount   period   is_max_period
0     a     2020-1-30       1          1          0
1     a     2020-1-30       2          1          0
2     a     2020-2-28       3          2          1
3     b     2020-1-30       5          1          0
4     b     2020-3-30       2          2          1

這將是解決這個問題的賭注方式嗎?

嘗試使用factorizemax進行transform

g = df.groupby(['store'])['date']
df['period'] = g.transform(lambda x : x.factorize()[0]+1)
df['is_max_period'] = df.date.eq(g.transform('max')).astype(int)
df
  store       date  amount  period  is_max_period
0     a  2020-1-30       1       1              0
1     a  2020-1-30       2       1              0
2     a  2020-2-28       3       2              1
3     b  2020-1-30       5       1              0
4     b  2020-3-30       2       2              1

暫無
暫無

聲明:本站的技術帖子網頁,遵循CC BY-SA 4.0協議,如果您需要轉載,請注明本站網址或者原文地址。任何問題請咨詢:yoyou2525@163.com.

 
粵ICP備18138465號  © 2020-2024 STACKOOM.COM