Questão de Estatística — Conhecimentos de estatística — FGV 2022
EstatísticaConhecimentos de estatística
- Código
- fg048639
- Banca
- FGV
- Órgão
- MPE-SC
- Ano
- 2022
- Nível
- Superior
- Cargo
- Analista de Dados e Pesquisa
Um modelo semântico vetorial foi criado com a seguinte definição:v(w)i = tf(w, di) ∙ idf(w, D)onde v é o vetor correspondente à palavra w, di é o i-ésimo documento da coleção D de artigos da Wikipédia, ordenados alfabeticamente por título, e tf e idf são, respectivamente, as funções de frequência de termo e inverso da frequência em documentos.A alternativa que classifica corretamente o modelo acima descrito e apresenta a razão correta para a classificação é:
- Alatente, pois v(w) descreve uma distribuição de tópicos em D;
- Blatente, pois o modelo produz vetores densos;
- Cexplícito, pois há uma interpretação intrínseca ao modelo para cada dimensão dos vetores;
- Dlatente, pois o modelo é construído de forma não supervisionada;
- Eexplícito, pois a informação do modelo é específica a um corpus.