Brock University · COSC 5P83

Aprendizado por Reforço

Denominação oficial : Reinforcement Learning

Créditos : 0.5Ano de referência : 2024-25

Esta referência descreve o catálogo indicado. Consulte a instituição para confirmar a oferta atual e as condições aplicáveis ao seu ano de ingresso.

Descrição

Aprendizado por Reforço (também oferecido como COSC 4P83) Introdução aos conceitos fundamentais de aprendizado por reforço incluindo bandits multi-armed, processos de decisão de Markov, métodos baseados em modelo e sem modelo (tais como programação dinâmica, métodos de Monte Carlo e métodos de diferença temporal) para aprender funções de valor e política. Soluções por aproximação incluindo aprendizado por reforço profundo.

Texto de referência na sua língua de origem

Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.

    Fontes e referências

    As datas e as fontes são mantidas para ajudá-lo a verificar os dados. As traduções são propostas para facilitar a leitura; a fonte oficial é a referência para condições e exigências.

    Fonte de referência : https://brocku.ca/webcal/2024/graduate/cosc.html

    Escreva para a StudyCanada

    Seu projeto ou uma dúvida: vamos continuar por e-mail.

    Usaremos estes dados para responder à sua mensagem. Privacidade

    Este formulário é destinado à StudyCanada. Para falar com a instituição, use os dados da ficha.