Pular para o conteúdo principal

Questão de Noções de Informática — Inteligência Artificial e Automação — FUVEST 2025

Noções de InformáticaInteligência Artificial e Automação
Código
qg502456
Banca
FUVEST
Órgão
USP
Ano
2025
Nível
Superior
Cargo
Analista de Sistemas
O pré-processamento de textos é uma etapa importante¬¬no processo de análise e classificação de dados textuais. Ele visa transformar textos brutos em um formato adequado para ser utilizado em algoritmos de aprendizado de máquina. Entre as técnicas mais comuns no pré-processamento de textos, estão a remoção de stop words, a tokenização, a lematização e o estemização. Considere o texto original a seguir:"O carro estava muito sujo, então ele decidiu limpar o carro depois de um longo dia de trabalho. O carro ficou brilhante após a limpeza."Com base nas técnicas de pré-processamento citadas, como ficará o texto original após a aplicação de tokenização e remoção de stop words?
  1. A["carro", "sujo", "decidir", "limpeza", "brilhante"]
  2. B["carro", "sujo", "decidiu", "limpar", "carro", "longo", "dia", "trabalho", "carro", "brilhante", "limpeza"]
  3. C["carro", "sujo", "decidiu", "limpar", "carro", "longo", "dia", "trabalho", "carro", "brilhante", "após", "limpeza"]
  4. D["carro", "limpar", "brilhante", "carro"]
  5. E["carro", "limpeza", "brilhante", "decidiu", "trabalho"]
Revelar gabarito e comentário

GabaritoB — ["carro", "sujo", "decidiu", "limpar", "carro", "longo", "dia", "trabalho", "carro", "brilhante", "limpeza"]

Link permanente: /questoes/qg502456