Pular para o conteúdo principal

Questão de Banco de Dados — Data Mining — CESPE / CEBRASPE 2026

Banco de DadosData Mining
Código
ce229318
Banca
CESPE / CEBRASPE
Órgão
TCE-RN
Ano
2026
Nível
Superior
Cargo
Analista Administrativo - Especialidade: Tecnologia da Informação
Em um processo de mineração de texto, a tokenização é o processo de dividir textos longos em palavras individuais, removendo-se espaços e pontuação, para fins de identificação da frequência de termos ou da estrutura de uma frase em um grande volume de documentos.
  1. CCerto
  2. EErrado
Revelar gabarito e comentário

GabaritoC — Certo

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Tokenização em mineração de texto

Gabarito: ✅ CERTO. A afirmação descreve corretamente a tokenização, etapa fundamental do pré-processamento em mineração de texto, que consiste em segmentar o texto em unidades menores (tokens), como palavras, removendo espaços e pontuação, para viabilizar análises como frequência de termos ou estrutura frasal.

A tokenização é uma das primeiras etapas da mineração de texto, que, conforme o contexto de Data Mining, busca extrair conhecimento de grandes volumes de dados textuais não estruturados. A definição apresentada está em linha com a prática: após a tokenização, os tokens podem ser submetidos a técnicas de processamento de linguagem natural, indexação e sumarização.

  1. 1Tokenização
  2. 2Remoção de stopwords
  3. 3Stemming/Lematização
  4. 4Análise de frequência
LEVEL · soulevel.com.br

CERTO.

Link permanente: /questoes/ce229318