Pular para o conteúdo principal

Questão de Engenharia de Software — Inteligencia Artificial — CESPE / CEBRASPE 2025

Engenharia de SoftwareInteligencia Artificial
Código
ce202069
Banca
CESPE / CEBRASPE
Órgão
EMBRAPA
Ano
2025
Nível
Superior
Cargo
Pesquisador – Área: Gestão da Informação – Subárea: Engenharia de Dados
Acerca de inteligência artificial e machine learning, julgue o item que se segue.Diferentemente do aprendizado supervisionado e não supervisionado, o aprendizado por reforço baseia-se em um agente que interage com um ambiente e recebe recompensas ou penalidades conforme suas ações, buscando maximizar um retorno cumulativo ao longo do tempo.
  1. CCerto
  2. EErrado
Revelar gabarito e comentário

GabaritoC — Certo

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Aprendizado por Reforço

Gabarito: ✅ CERTO. A afirmação está correta. O aprendizado por reforço (RL) é um dos três paradigmas principais do aprendizado de máquina, ao lado do supervisionado e do não supervisionado. Nele, um agente aprende a tomar decisões interagindo com um ambiente: a cada ação, recebe uma recompensa (positiva) ou penalidade (negativa), e seu objetivo é maximizar o retorno cumulativo ao longo do tempo. Essa descrição bate exatamente com o conceito clássico de RL, conforme definido na literatura (Sutton & Barto, por exemplo).

A diferenciação apresentada também é precisa:

  • Aprendizado supervisionado: aprende a partir de dados rotulados (entrada-saída conhecida).

  • Aprendizado não supervisionado: encontra padrões em dados sem rótulos.

  • Aprendizado por reforço: aprende por tentativa e erro com base em sinais de recompensa.

Portanto, o item está Certo.

Paradigmas de ML
  • 1Supervisionado
    • Dados rotulados (entrada → saída)
  • 2Não supervisionado
    • Dados sem rótulos (padrões)
  • 3Por reforço
    • Agente interage com ambiente
    • Ação → recompensa ou penalidade
    • Objetivo: maximizar retorno cumulativo
LEVEL · soulevel.com.br

Link permanente: /questoes/ce202069