Данная справка описывает указанный каталог. Обратитесь в учреждение, чтобы подтвердить актуальное предложение и условия, применимые к вашему началу обучения.
Описание
Обучение с подкреплением (также предлагается как COSC 4P83) Введение в фундаментальные концепции обучения с подкреплением, включая многорукие бандиты, марковские процессы принятия решений, модельные и немодельные методы (такие как динамическое программирование, методы Монте-Карло и методы временной разности) для обучения функций ценности и политик. Приближённые решения, включая глубокое обучение с подкреплением.
Текст источника на языке оригинала
Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.
Источники и ссылки
Даты и источники сохраняются, чтобы помочь вам проверить сведения. Переводы предлагаются для удобства чтения; официальным источником для условий и требований является оригинал.
Исходная ссылка : https://brocku.ca/webcal/2024/graduate/cosc.html