Pular para o conteúdo principal

Questão de Banco de Dados — Banco de Dados — CESPE / CEBRASPE 2024

Banco de DadosBanco de Dados
Código
ce172783
Banca
CESPE / CEBRASPE
Órgão
CTI
Ano
2024
Nível
Superior
Cargo
Tecnologista Pleno 2 - I - Especialidade: Tecnologias Habilitadoras - Área de Atuação: Inteligência Artificial e Ciências de Dados
Com base em obtenção, limpeza e pré-processamento de dados, julgue o próximo item.A toquenização (do inglês tokenization) de palavras é uma atividade inerente aos algoritmos de análise granular de palavras em documentos.
  1. CCerto
  2. EErrado
Revelar gabarito e comentário

GabaritoC — Certo

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Tokenização em Pré-processamento de Dados

Gabarito: CERTO (C). A tokenização de palavras é de fato uma atividade inerente aos algoritmos de análise granular de palavras em documentos. Esse processo consiste em dividir um texto em unidades menores (tokens), como palavras ou frases, etapa fundamental para tarefas de mineração de texto, processamento de linguagem natural e análise de documentos.

A afirmação descreve corretamente uma prática padrão no pré-processamento de dados textuais. A análise granular de palavras depende da tokenização para identificar e manipular cada elemento individualmente.

Não há pegadinha; o conceito é direto e bem estabelecido na área de banco de dados e análise de dados.

CERTO

Link permanente: /questoes/ce172783