按行切片 Pandas DataFrame

Question

我正在处理从 h5 文件作为hdf = pandas.HDFStore('Survey.h5')到 pandas package 加载的调查数据。在这个DataFrame中，所有行都是单个调查的结果，而列是答案针对单个调查中的所有问题。

我的目标是将此数据集缩减为较小的DataFrame ，其中仅包含对某个问题具有特定描述答案的行，即此列中的所有值都相同。 我能够确定具有这种情况的所有行的索引值，但我找不到如何删除这些行或仅使用这些行创建新的 df。

Answer 1

In [36]: df
Out[36]:
   A  B  C  D
a  0  2  6  0
b  6  1  5  2
c  0  2  6  0
d  9  3  2  2

In [37]: rows
Out[37]: ['a', 'c']

In [38]: df.drop(rows)
Out[38]:
   A  B  C  D
b  6  1  5  2
d  9  3  2  2

In [39]: df[~((df.A == 0) & (df.B == 2) & (df.C == 6) & (df.D == 0))]
Out[39]:
   A  B  C  D
b  6  1  5  2
d  9  3  2  2

In [40]: df.ix[rows]
Out[40]:
   A  B  C  D
a  0  2  6  0
c  0  2  6  0

In [41]: df[((df.A == 0) & (df.B == 2) & (df.C == 6) & (df.D == 0))]
Out[41]:
   A  B  C  D
a  0  2  6  0
c  0  2  6  0

Answer 2

如果您已经知道索引，则可以使用.loc ：

In [12]: df = pd.DataFrame({"a": [1,2,3,4,5], "b": [4,5,6,7,8]})

In [13]: df
Out[13]:
   a  b
0  1  4
1  2  5
2  3  6
3  4  7
4  5  8

In [14]: df.loc[[0,2,4]]
Out[14]:
   a  b
0  1  4
2  3  6
4  5  8

In [15]: df.loc[1:3]
Out[15]:
   a  b
1  2  5
2  3  6
3  4  7

Answer 3

如果您只需要获得最top的行； 你可以使用df.head(10)

Answer 4

使用query来搜索特定条件：

In [3]: df
Out[3]: 
   age family   name
0    1      A   john 
1   36      A  jason 
2   32      A   jane 
3   26      B   jack 
4   30      B  james 

In [4]: df.query('age > 30 & family == "A"')
Out[4]: 
   age family   name
1   36      A  jason 
2   32      A   jane

按行切片 Pandas DataFrame

问题描述

4 个解决方案

解决方案1
40 已采纳 2012-08-09 11:26:08

解决方案2
8 2016-12-11 03:14:24

解决方案3
0 2022-03-24 12:07:42

解决方案4
0 2022-06-10 20:00:15

按行切片 Pandas DataFrame

问题描述

4 个解决方案

解决方案1 40 已采纳 2012-08-09 11:26:08

解决方案2 8 2016-12-11 03:14:24

解决方案3 0 2022-03-24 12:07:42

解决方案4 0 2022-06-10 20:00:15

解决方案1
40 已采纳 2012-08-09 11:26:08

解决方案2
8 2016-12-11 03:14:24

解决方案3
0 2022-03-24 12:07:42

解决方案4
0 2022-06-10 20:00:15