Pular para o conteúdo
Carreira Pública

Q53883 – Tecnologia da Informação – Centro Brasileiro de Pesquisa em Avaliação e Seleção (CEBRASPE/CESPE) 2023

1Q53883

Tecnologia da Informação

Nos algoritmos de aprendizado por reforço, o agente recebe uma recompensa atrasada na próxima etapa de tempo para avaliar sua ação anterior; seu objetivo, então, é maximizar a recompensa.

Questões de Tecnologia da Informação relacionadas