Метод describe библиотеки pandas: подробное описание и примеры использования
Функция describe() в библиотеке Pandas предоставляет набор статистических данных для числовых столбцов датафрейма. Она возвращает сводку о средних значениях, стандартных отклонениях, минимальных и максимальных значениях, медианах, процентилях и т.д. Данные могут быть отфильтрованы, чтобы описывать только определенный тип данных или столбцы.
Пример кода:
import pandas as pd
data = pd.read_csv('data.csv')
print(data.describe())
Функция describe() вернет сводку статистических данных для всех числовых столбцов датафрейма data. Она включает средние значения, стандартные отклонения, минимальные и максимальные значения, медианы и процентили.
Вы можете использовать дополнительные параметры, чтобы настроить вывод. Например, чтобы исключить некоторые статистики, задайте параметр exclude:
data.describe(exclude=['object']) # исключить статистики по нечисловым столбцам
Вы также можете описывать только определенные столбцы, указав их имена в параметре include:
data.describe(include=['float64']) # описывает только числовые столбцы с floating point числами
Кроме того, можно использовать describe() как объект серии, чтобы получить определенную статистическую информацию:
data['column_name'].describe() # описывает только заданный столбец датафрейма
Таким образом, функция describe() является полезным инструментом для анализа числовых данных в датафреймах Pandas.