Brock University · COSC 5P83

Aprendizaje por refuerzo

Título oficial : Reinforcement Learning

Créditos : 0.5Año de referencia : 2024-25

Esta referencia describe el catálogo indicado. Consulte con la institución para confirmar la oferta actual y las condiciones aplicables a su ingreso.

Descripción

Aprendizaje por refuerzo (también ofrecido como COSC 4P83) Introducción a conceptos fundamentales de aprendizaje por refuerzo incluyendo bandidos multi-brazo, procesos de decisión de Markov, métodos basados en modelo y sin modelo (como programación dinámica, métodos de Monte Carlo y métodos de diferencia temporal) para aprender funciones de valor y política. Soluciones de aproximación incluyendo aprendizaje por refuerzo profundo.

Texto de referencia en su idioma de origen

Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.

    Fuentes y referencias

    Se conservan las fechas y las fuentes para ayudarle a verificar la información. Las traducciones se proponen para facilitar la lectura; la fuente oficial es la referencia para las condiciones y los requisitos.

    Referencia de la fuente : https://brocku.ca/webcal/2024/graduate/cosc.html

    Escribe a StudyCanada

    Tu proyecto o una pregunta: continuemos por correo electrónico.

    Utilizaremos estos datos para responder a tu consulta. Privacidad

    Este formulario se dirige a StudyCanada. Para contactar con esta institución, utiliza los datos de su ficha.