Pular para o conteúdo principal

Questão de Programação — Linguagens de programação — CESPE / CEBRASPE 2023

ProgramaçãoLinguagens de programação
Código
ce153861
Banca
CESPE / CEBRASPE
Órgão
DATAPREV
Ano
2023
Nível
Médio
Cargo
Analista de Tecnologia da Informação - Perfil: Inteligência da informação
No que se refere à biblioteca Pandas, julgue o próximo item.import pandas as pda = [10, 78, 23]myvar = pd.Series(a, index = [“x”, “y”, “z”])print(myvar.describe())Caso o código em Python precedente seja executado, então será apresentado em tela o que se segue.count 4.000000mean 38.000000std 6.097091min 10.00000025% 16.50000050% 23.00000075% 50.500000max 78.000000dtype: float64
  1. CCerto
  2. EErrado
Revelar gabarito e comentário

GabaritoE — Errado

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Pandas Series – Método describe()

Gabarito: ❌ ERRADO (alternativa E). A saída apresentada está incorreta. Para uma Series com três elementos, o método describe() retorna count=3, não 4. Além disso, os valores de média, desvio padrão e percentis também não correspondem aos dados fornecidos.

A banca testa o conhecimento sobre o funcionamento básico do Pandas e do método describe(). O código cria uma Series a partir da lista [10, 78, 23] com índices ['x','y','z']. Ao chamar myvar.describe(), o Pandas calcula estatísticas descritivas para os três valores.

Análise do erro

  • A saída afirma count 4.000000, mas a Series tem 3 elementos. O count correto seria 3.

  • A média (mean) informada é 38, mas a média real é (10+78+23)/3 = 111/3 = 37.

  • O desvio padrão (std) informado é aproximadamente 6,097. O desvio padrão amostral correto é:

    σ=(1037)2+(7837)2+(2337)231=729+1681+1962=130336.10\sigma = \sqrt{\frac{(10-37)^2 + (78-37)^2 + (23-37)^2}{3-1}} = \sqrt{\frac{729 + 1681 + 196}{2}} = \sqrt{1303} \approx 36.10

  • Os percentis apresentados (25% = 16.5, 50% = 23, 75% = 50.5) também não correspondem aos dados ordenados (10, 23, 78). O percentil 25% seria aproximadamente 16.5? Isso não faz sentido com apenas 3 valores. O Pandas usa interpolação linear, mas a saída apresentada é inconsistente.

Portanto, a assertiva está errada. O gabarito oficial é a opção E.

PEGA ESSA DICA!

Sempre confira o count e os valores básicos antes de aceitar uma saída de describe(). Para uma Series pequena, você pode calcular manualmente a média e o desvio padrão para verificar. Lembre-se: count = número de elementos não nulos.

Link permanente: /questoes/ce153861