Questão de Algoritmos e Estrutura de Dados — Conceitos Básicos e Algoritmos — Instituto Consulplan 2023
Algoritmos e Estrutura de Dados›Conceitos Básicos e Algoritmos
Código
qq984873
Banca
Instituto Consulplan
Órgão
MPE-BA
Ano
2023
Nível
Superior
Cargo
Analista Técnico – Análise de Sistemas
Considerada uma evolução da área de recuperação de informações, mineração de textos é um processo de descoberta de conhecimento, que utiliza técnicas de análise e extração de dados a partir de textos, frases ou apenas palavras. A primeira etapa do processo de descoberta de conhecimento em textos, a qual envolve a seleção dos dados que constituem a base de textos de interesse e o trabalho inicial para tentar selecionar o núcleo que melhor expressa o conteúdo destes textos é:
AAnálise semântica.
BSeleção dos termos.
CPreparação dos dados.
DIndexação e normalização.
ECálculo da relevância dos termos.
Revelar gabarito e comentário▾
GabaritoC — Preparação dos dados.
Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.
Mineração de textos – Etapas do processo
Gabarito: letra C. A primeira etapa do processo de descoberta de conhecimento em textos é a preparação dos dados (também chamada de pré-processamento), que envolve a seleção dos textos de interesse e o trabalho inicial para extrair o núcleo representativo do conteúdo. As demais alternativas referem-se a etapas posteriores ou a técnicas específicas.
Na mineração de textos, o processo segue um fluxo semelhante ao KDD (Knowledge Discovery in Databases), iniciando com a preparação dos dados brutos. Isso inclui tarefas como limpeza, transformação, redução e seleção dos termos mais relevantes. Somente após essa preparação é que se parte para a indexação, normalização, análise semântica e cálculo de relevância.
Alternativa A — ❌ Incorreta
A análise semântica é uma tarefa avançada que ocorre após a preparação e indexação dos textos. Não corresponde à primeira etapa, pois exige que os dados já estejam estruturados e limpos.
Alternativa B — ❌ Incorreta
A seleção dos termos é uma atividade que faz parte da preparação, mas não a representa por completo. A primeira etapa é mais abrangente, englobando a coleta e o tratamento geral dos dados.
Alternativa C — ✅ Correta ⟵ GABARITO
A preparação dos dados é a primeira etapa, conforme descrito no enunciado: seleção dos dados e trabalho inicial para selecionar o núcleo que expressa o conteúdo.
Alternativa D — ❌ Incorreta
Indexação e normalização são etapas posteriores à preparação, com o objetivo de organizar os termos e representar o texto de forma estruturada.
Alternativa E — ❌ Incorreta
O cálculo da relevância dos termos (como TF-IDF) é uma técnica aplicada após a indexação, portanto não é a primeira etapa.