Brock University · COSC 5P83

Apprentissage par renforcement

Intitulé officiel : Reinforcement Learning

Crédits : 0.5Année de référence : 2024-25

Cette référence décrit le catalogue indiqué. Consultez l’établissement pour confirmer l’offre actuelle et les conditions applicables à votre rentrée.

Description

Apprentissage par renforcement (offert aussi sous COSC 4P83) Introduction aux concepts fondamentaux de l'apprentissage par renforcement, y compris les bandits multi-bras, les processus de décision de Markov, les méthodes basées sur le modèle et sans modèle (telles que la programmation dynamique, les méthodes de Monte Carlo et les méthodes de différence temporelle) pour apprendre les fonctions de valeur et de politique. Solutions par approximation incluant l'apprentissage par renforcement profond.

Texte de référence dans sa langue d’origine

Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.

    Sources et références

    Les dates et les sources sont conservées pour vous aider à vérifier les renseignements. Les traductions sont proposées pour faciliter la lecture; la source officielle fait référence pour les conditions et les exigences.

    Référence source : https://brocku.ca/webcal/2024/graduate/cosc.html

    Écrivez à StudyCanada

    Votre projet, une question : poursuivons l’échange par courriel.

    Nous utiliserons ces coordonnées pour répondre à votre demande. Confidentialité

    Ce formulaire s’adresse à StudyCanada. Pour joindre cet établissement, utilisez les coordonnées indiquées dans sa fiche.