Pular para o conteúdo principal

Questão de Engenharia de Software — Inteligencia Artificial — CESPE / CEBRASPE 2023

Engenharia de SoftwareInteligencia Artificial
Código
ce159946
Banca
CESPE / CEBRASPE
Órgão
SEFIN de Fortaleza - CE
Ano
2023
Nível
Superior
Cargo
Analista Fazendário Municipal - Área de Conhecimento: Ciência da Computação, Informática/Processamento de Dados
Julgue o item a seguir, a respeito de inteligência artificial (IA) e machine learning.Nos algoritmos de aprendizado por reforço, o agente recebe uma recompensa atrasada na próxima etapa de tempo para avaliar sua ação anterior; seu objetivo, então, é maximizar a recompensa.
  1. CCerto
  2. EErrado
Revelar gabarito e comentário

GabaritoC — Certo

Comentário gerado por IA. É um apoio ao estudo, ancorado em fontes, mas pode conter imprecisões — confira sempre na fonte oficial (lei, súmula, edital e gabarito da banca). Encontrou um erro? Use “Reportar”.

Aprendizado por Reforço

Gabarito: Certo. A afirmação descreve corretamente o ciclo fundamental do aprendizado por reforço: o agente executa uma ação em um estado, recebe uma recompensa (que pode ser atrasada, geralmente na próxima etapa de tempo) e ajusta sua política para maximizar a recompensa cumulativa ao longo do tempo. O objetivo central é de fato maximizar a recompensa esperada, seja imediata ou futura.

A descrição está alinhada com a definição clássica de Sutton e Barto (2018): o agente interage com o ambiente, obtém um sinal de recompensa (muitas vezes defasado) e busca maximizar o retorno total. Portanto, a assertiva está Certa.

  1. 1Agente observa estado
  2. 2Executa ação
  3. 3Ambiente retorna recompensa (pode ser atrasada)
  4. 4Agente ajusta política
  5. 5Objetivo: maximizar recompensa cumulativa
LEVEL · soulevel.com.br

Link permanente: /questoes/ce159946