Cette référence décrit le catalogue indiqué. Consultez l’établissement pour confirmer l’offre actuelle et les conditions applicables à votre rentrée.
Description
Apprentissage par renforcement (offert aussi sous COSC 4P83) Introduction aux concepts fondamentaux de l'apprentissage par renforcement, y compris les bandits multi-bras, les processus de décision de Markov, les méthodes basées sur le modèle et sans modèle (telles que la programmation dynamique, les méthodes de Monte Carlo et les méthodes de différence temporelle) pour apprendre les fonctions de valeur et de politique. Solutions par approximation incluant l'apprentissage par renforcement profond.
Texte de référence dans sa langue d’origine
Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.
Sources et références
Les dates et les sources sont conservées pour vous aider à vérifier les renseignements. Les traductions sont proposées pour faciliter la lecture; la source officielle fait référence pour les conditions et les exigences.
Référence source : https://brocku.ca/webcal/2024/graduate/cosc.html