Aprendizagem por Reforço

Reinforcement Learning para Controle

Autor
Afiliação

Prof. Dr. Raphael Teixeira

Universidade Federal do Pará

Um agente aprende a agir sobre um ambiente por tentativa e erro, maximizando uma recompensa acumulada — a contraparte, orientada a dados, do controle ótimo.