大熊貓-根據“下一個”行值創建新列

Question

我有以下數據框：

   date      country   
   6/1/18    USA
   6/1/18    BEL
   6/4/18    USA
   6/5/18    BEL
   6/6/18    USA

我想創建一個列，告訴您相應國家/地區的下一個日期。 如果有幫助，您可以假定日期已排序。 如果日期是該國家/地區的最后日期，則可以使用相同的日期或空值填寫下一個日期。

   date      country   next_date
   6/1/18    USA       6/4/18
   6/1/18    BEL       6/5/18
   6/4/18    USA       6/6/18
   6/5/18    BEL       6/5/18
   6/6/18    USA       6/6/18

Answer 1

您可以使用groupby和shift來填充下一個可用值，但是，這將使行沒有下一個可用日期，即NaN ：

df.assign(ndate=df.groupby('country').date.shift(-1))

     date country   ndate
0  6/1/18     USA  6/4/18
1  6/1/18     BEL  6/5/18
2  6/4/18     USA  6/6/18
3  6/5/18     BEL     NaN
4  6/6/18     USA     NaN

如果您想填寫與上次看到日期這些值，你可以簡單地fillna與date列：

df.assign(ndate=df.groupby('country').date.shift(-1)).fillna({'ndate': df.date})

     date country   ndate
0  6/1/18     USA  6/4/18
1  6/1/18     BEL  6/5/18
2  6/4/18     USA  6/6/18
3  6/5/18     BEL  6/5/18
4  6/6/18     USA  6/6/18

Answer 2

您也可以使用transform 。 我選擇將最終日期保留為NaN值。

>>> df.assign(next_date=df.groupby('country')['date'].transform(
                  lambda group: group.shift(-1)))
     date country next_date
0  6/1/18     USA    6/4/18
1  6/1/18     BEL    6/5/18
2  6/4/18     USA    6/6/18
3  6/5/18     BEL       NaN
4  6/6/18     USA       NaN

大熊貓-根據“下一個”行值創建新列

問題描述

2 個解決方案

解決方案1
3 已采納 2018-09-06 19:19:07

解決方案2
1 2018-09-06 19:26:21

大熊貓-根據“下一個”行值創建新列

問題描述

2 個解決方案

解決方案1 3 已采納 2018-09-06 19:19:07

解決方案2 1 2018-09-06 19:26:21

解決方案1
3 已采納 2018-09-06 19:19:07

解決方案2
1 2018-09-06 19:26:21