Esta referência descreve o catálogo indicado. Consulte a instituição para confirmar a oferta atual e as condições aplicáveis ao seu ano de ingresso.
Descrição
Aprendizado por Reforço (também oferecido como COSC 4P83) Introdução aos conceitos fundamentais de aprendizado por reforço incluindo bandits multi-armed, processos de decisão de Markov, métodos baseados em modelo e sem modelo (tais como programação dinâmica, métodos de Monte Carlo e métodos de diferença temporal) para aprender funções de valor e política. Soluções por aproximação incluindo aprendizado por reforço profundo.
Texto de referência na sua língua de origem
Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.
Fontes e referências
As datas e as fontes são mantidas para ajudá-lo a verificar os dados. As traduções são propostas para facilitar a leitura; a fonte oficial é a referência para condições e exigências.
Fonte de referência : https://brocku.ca/webcal/2024/graduate/cosc.html