Questão de Programação — Python — Quadrix 2024
- Código
- qg354199
- Banca
- Quadrix
- Órgão
- IBICT
- Ano
- 2024
- Nível
- Superior
- Cargo
- Tecnologista - Tecnologia da Informação
- CCerto
- EErrado
GabaritoC — Certo
Gabarito: ✅ CERTO. A biblioteca NLTK (Natural Language Toolkit) é, de fato, a principal ferramenta em Python para processamento de linguagem natural (NLP), fornecendo módulos para tokenização, análise morfológica, classificação de texto, entre outros. O item está correto ao afirmar que seu objetivo principal é realizar NLP em textos.
O processamento de linguagem natural (PLN ou NLP, do inglês Natural Language Processing) é o campo da inteligência artificial que estuda a interação entre computadores e linguagem humana. O objetivo é capacitar máquinas a entender, interpretar e manipular texto ou fala de forma útil. A NLTK é uma das bibliotecas mais tradicionais e completas para esse fim na linguagem Python, oferecendo desde utilitários básicos, como tokenização (divisão do texto em palavras ou frases) e stemming (redução de palavras à sua raiz), até ferramentas mais avançadas, como part-of-speech tagging (etiquetagem das classes gramaticais), análise sintática e classificação de texto.
A biblioteca foi criada em 2001 por Steven Bird e Edward Loper, como parte de um curso de linguística computacional na Universidade da Pensilvânia. Desde então, tornou-se um padrão de facto para ensino e pesquisa em NLP, sendo amplamente utilizada em projetos acadêmicos e comerciais. É importante destacar que a NLTK não é a única biblioteca de NLP em Python — existem outras como spaCy, TextBlob e Gensim —, mas é certamente uma das mais conhecidas e abrangentes, com uma vasta coleção de corpora e recursos linguísticos.
Na prática, um analista que deseja processar textos com NLTK pode, por exemplo, carregar um corpus, tokenizar as sentenças, remover stopwords (palavras de baixo valor semântico, como artigos e preposições) e aplicar um classificador para análise de sentimentos. O fluxo típico envolve a importação da biblioteca, o download de recursos adicionais (como modelos de tokenização) e a aplicação das funções sobre o texto. A biblioteca também integra-se bem com outras ferramentas do ecossistema Python, como Pandas, para manipulação de dados tabulares, e NumPy, para operações numéricas.
A distinção que importa aqui é entre a NLTK e outras bibliotecas de propósito geral. Enquanto Pandas é especializada em análise e manipulação de dados estruturados (tabelas, séries temporais), a NLTK é especializada em dados não estruturados, ou seja, texto livre. A linguagem R, por sua vez, também possui pacotes para NLP (como tm e text2vec), mas a NLTK é especificamente uma biblioteca da linguagem Python. A banca explora exatamente esse conhecimento: saber qual biblioteca é usada para qual finalidade.
A pegadinha que a banca poderia explorar seria inverter as funções: afirmar que a NLTK serve para análise de dados tabulares ou que Pandas serve para NLP. Nesta questão, porém, a afirmação é direta e correta, sem armadilha. O candidato que conhece o papel da NLTK no ecossistema Python não encontra dificuldade em marcar a alternativa correta.
✅ CERTO — A NLTK é a biblioteca padrão de Python para processamento de linguagem natural, com o objetivo de fornecer ferramentas para trabalhar com texto e linguagem humana.
Link permanente: /questoes/qg354199