Brock University · COSC 5P83

Обучение с подкреплением

Официальное наименование : Reinforcement Learning

Кредиты : 0.5Год, на который относятся данные : 2024-25

Данная справка описывает указанный каталог. Обратитесь в учреждение, чтобы подтвердить актуальное предложение и условия, применимые к вашему началу обучения.

Описание

Обучение с подкреплением (также предлагается как COSC 4P83) Введение в фундаментальные концепции обучения с подкреплением, включая многорукие бандиты, марковские процессы принятия решений, модельные и немодельные методы (такие как динамическое программирование, методы Монте-Карло и методы временной разности) для обучения функций ценности и политик. Приближённые решения, включая глубокое обучение с подкреплением.

Текст источника на языке оригинала

Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.

    Источники и ссылки

    Даты и источники сохраняются, чтобы помочь вам проверить сведения. Переводы предлагаются для удобства чтения; официальным источником для условий и требований является оригинал.

    Исходная ссылка : https://brocku.ca/webcal/2024/graduate/cosc.html

    Напишите в StudyCanada

    Расскажите о своих планах или задайте вопрос. Продолжим общение по электронной почте.

    Мы используем эти контактные данные, чтобы ответить на ваш вопрос. Конфиденциальность

    Эта форма предназначена для StudyCanada. Чтобы связаться с учебным заведением, используйте контакты в его карточке.