Tham chiếu này mô tả mục lục được chỉ ra. Hãy liên hệ cơ sở để xác nhận chương trình hiện tại và các điều kiện áp dụng cho kỳ nhập học của bạn.
Mô tả
Học Tăng cường (cũng được cung cấp như COSC 4P83) Giới thiệu các khái niệm cơ bản về học tăng cường bao gồm băng cánh nhiều tay (multi-armed bandits), quá trình quyết định Markov, phương pháp dựa trên mô hình và không dựa trên mô hình (chẳng hạn luận chương động, phương pháp Monte Carlo và phương pháp sai phân thời gian) để học các hàm giá trị và chính sách. Các nghiệm xấp xỉ bao gồm học tăng cường sâu.
Văn bản tham chiếu bằng ngôn ngữ gốc
Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.
Nguồn và tham khảo
Ngày và nguồn được giữ lại để giúp bạn kiểm tra thông tin. Các bản dịch được cung cấp để dễ đọc; nguồn chính thức là tham chiếu cho các điều kiện và yêu cầu.
Nguồn tham khảo : https://brocku.ca/webcal/2024/graduate/cosc.html