Brock University · COSC 5P83

Học tăng cường

Tiêu đề chính thức : Reinforcement Learning

Tín chỉ : 0.5Năm tham chiếu : 2024-25

Tham chiếu này mô tả mục lục được chỉ ra. Hãy liên hệ cơ sở để xác nhận chương trình hiện tại và các điều kiện áp dụng cho kỳ nhập học của bạn.

Mô tả

Học Tăng cường (cũng được cung cấp như COSC 4P83) Giới thiệu các khái niệm cơ bản về học tăng cường bao gồm băng cánh nhiều tay (multi-armed bandits), quá trình quyết định Markov, phương pháp dựa trên mô hình và không dựa trên mô hình (chẳng hạn luận chương động, phương pháp Monte Carlo và phương pháp sai phân thời gian) để học các hàm giá trị và chính sách. Các nghiệm xấp xỉ bao gồm học tăng cường sâu.

Văn bản tham chiếu bằng ngôn ngữ gốc

Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.

    Nguồn và tham khảo

    Ngày và nguồn được giữ lại để giúp bạn kiểm tra thông tin. Các bản dịch được cung cấp để dễ đọc; nguồn chính thức là tham chiếu cho các điều kiện và yêu cầu.

    Nguồn tham khảo : https://brocku.ca/webcal/2024/graduate/cosc.html

    Liên hệ StudyCanada

    Chia sẻ kế hoạch hoặc câu hỏi của bạn. Chúng ta sẽ tiếp tục trao đổi qua email.

    Chúng tôi sử dụng thông tin liên hệ này để trả lời yêu cầu của bạn. Quyền riêng tư

    Biểu mẫu này gửi đến StudyCanada. Để liên hệ với trường, hãy dùng thông tin trong hồ sơ trường.