Pular para o conteúdo principal

Questão de Estatística — Conhecimentos de estatística — FGV 2022

EstatísticaConhecimentos de estatística
Código
fg048639
Banca
FGV
Órgão
MPE-SC
Ano
2022
Nível
Superior
Cargo
Analista de Dados e Pesquisa
Um modelo semântico vetorial foi criado com a seguinte definição:v(w)i = tf(w, di) ∙ idf(w, D)onde v é o vetor correspondente à palavra w, di é o i-ésimo documento da coleção D de artigos da Wikipédia, ordenados alfabeticamente por título, e tf e idf são, respectivamente, as funções de frequência de termo e inverso da frequência em documentos.A alternativa que classifica corretamente o modelo acima descrito e apresenta a razão correta para a classificação é:
  1. Alatente, pois v(w) descreve uma distribuição de tópicos em D;
  2. Blatente, pois o modelo produz vetores densos;
  3. Cexplícito, pois há uma interpretação intrínseca ao modelo para cada dimensão dos vetores;
  4. Dlatente, pois o modelo é construído de forma não supervisionada;
  5. Eexplícito, pois a informação do modelo é específica a um corpus.
Revelar gabarito e comentário

GabaritoC — explícito, pois há uma interpretação intrínseca ao modelo para cada dimensão dos vetores;

Link permanente: /questoes/fg048639