Як відфільтрувати pandas dataframe за кількома умовами


Часто вам може знадобитися фільтрувати pandas DataFrame за кількома умовами. На щастя, це легко зробити за допомогою логічних операцій.

У цьому підручнику наведено кілька прикладів того, як фільтрувати такі pandas DataFrame за кількома умовами:

 import pandas as pd

#createDataFrame
df = pd.DataFrame({'team': ['A', 'A', 'B', 'B', 'C'],
                   'points': [25, 12, 15, 14, 19],
                   'assists': [5, 7, 7, 9, 12],
                   'rebounds': [11, 8, 10, 6, 6]})

#view DataFrame 
df

        team points assists rebounds
0 to 25 5 11
1 to 12 7 8
2 B 15 7 10
3 B 14 9 6
4 C 19 12 6

Приклад 1: фільтрування за кількома умовами за допомогою «І»

Наступний код демонструє, як фільтрувати DataFrame за допомогою оператора and ( & ):

 #return only rows where points is greater than 13 and assists is greater than 7
df[(df. points > 13) & (df. assists > 7)]

        team points assists rebounds
3 B 14 9 6
4 C 19 12 6

#return only rows where team is 'A' and points is greater than or equal to 15
df[(df. team == 'A') & (df. points >= 15)]


        team points assists rebounds
0 to 25 5 11

Приклад 2: фільтрування за кількома умовами за допомогою «Або»

Наступний код демонструє, як фільтрувати DataFrame за допомогою оператора or ( | ):

 #return only rows where points is greater than 13 or assists is greater than 7
df[(df. dots > 13) | (df. assists > 7)]


        team points assists rebounds
0 to 25 5 11
2 B 15 7 10
3 B 14 9 6
4 C 19 12 6

#return only rows where team is 'A' or points is greater than or equal to 15
df[( df.team == 'A') | (df. points >= 15)]

        team points assists rebounds
0 to 25 5 11
1 to 12 7 8
2 B 15 7 10
4 C 19 12 6

Приклад 3: фільтрування за кількома умовами за допомогою списку

Наступний код демонструє, як фільтрувати DataFrame, де значення рядків знаходяться в списку.

 #define a list of values
filter_list = [12, 14, 15]

#return only rows where points is in the list of values
df[df. points . isin (filter_list)]

	team points assists rebounds
1 to 12 7 8
2 B 15 7 10
3 B 14 9 6

#define another list of values
filter_list2 = ['A', 'C']

#return only rows where team is in the list of values
df[df. team . isin (filter_list2)]


        team points assists rebounds
0 to 25 5 11
1 to 12 7 8
4 C 19 12 6

Ви можете знайти більше посібників щодо панди тут .

Додати коментар

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *