Compartilhar via


Descrever

Calcula estatísticas básicas para colunas numéricas e de cadeia de caracteres.

Sintaxe

describe(*cols: Union[str, List[str]])

Parâmetros

Parâmetro Tipo Descrição
cols str, lista, opcional Nome da coluna ou lista de nomes de coluna a serem descritos por (padrão Todas as colunas).

Devoluções

DataFrame: um novo DataFrame que descreve (fornece estatísticas) dado DataFrame.

Observações

Essa função destina-se à análise de dados exploratória, pois não garantimos a compatibilidade com versões anteriores do esquema do DataFrame resultante.

Use o resumo para estatísticas expandidas e controle sobre quais estatísticas calcular.

Exemplos

df = spark.createDataFrame(
    [("Bob", 13, 40.3, 150.5), ("Alice", 12, 37.8, 142.3), ("Tom", 11, 44.1, 142.2)],
    ["name", "age", "weight", "height"],
)
df.describe(['age']).show()
# +-------+----+
# |summary| age|
# +-------+----+
# |  count|   3|
# |   mean|12.0|
# | stddev| 1.0|
# |    min|  11|
# |    max|  13|
# +-------+----+

df.describe(['age', 'weight', 'height']).show()
# +-------+----+------------------+-----------------+
# |summary| age|            weight|           height|
# +-------+----+------------------+-----------------+
# |  count|   3|                 3|                3|
# |   mean|12.0| 40.73333333333333|            145.0|
# | stddev| 1.0|3.1722757341273704|4.763402145525822|
# |    min|  11|              37.8|            142.2|
# |    max|  13|              44.1|            150.5|
# +-------+----+------------------+-----------------+