Referensi ini menggambarkan katalog yang disebutkan. Hubungi lembaga untuk mengonfirmasi penawaran saat ini dan ketentuan yang berlaku untuk pendaftaran Anda.
Deskripsi
Reinforcement Learning (juga ditawarkan sebagai COSC 4P83) Pengantar konsep dasar reinforcement learning termasuk multi-armed bandits, proses keputusan Markov, metode berbasis-model dan tanpa-model (seperti pemrograman dinamis, metode Monte Carlo, dan metode temporal-difference) untuk mempelajari fungsi nilai dan kebijakan. Solusi aproksimasi termasuk deep reinforcement learning.
Teks rujukan dalam bahasa aslinya
Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.
Sumber dan referensi
Tanggal dan sumber disimpan untuk membantu Anda memverifikasi informasi. Terjemahan disediakan untuk memudahkan pembacaan; sumber resmi menjadi rujukan untuk syarat dan ketentuan.
Referensi sumber : https://brocku.ca/webcal/2024/graduate/cosc.html