Brock University · COSC 5P83

Pembelajaran Penguatan

Nama resmi : Reinforcement Learning

Kredit : 0.5Tahun acuan : 2024-25

Referensi ini menggambarkan katalog yang disebutkan. Hubungi lembaga untuk mengonfirmasi penawaran saat ini dan ketentuan yang berlaku untuk pendaftaran Anda.

Deskripsi

Reinforcement Learning (juga ditawarkan sebagai COSC 4P83) Pengantar konsep dasar reinforcement learning termasuk multi-armed bandits, proses keputusan Markov, metode berbasis-model dan tanpa-model (seperti pemrograman dinamis, metode Monte Carlo, dan metode temporal-difference) untuk mempelajari fungsi nilai dan kebijakan. Solusi aproksimasi termasuk deep reinforcement learning.

Teks rujukan dalam bahasa aslinya

Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.

    Sumber dan referensi

    Tanggal dan sumber disimpan untuk membantu Anda memverifikasi informasi. Terjemahan disediakan untuk memudahkan pembacaan; sumber resmi menjadi rujukan untuk syarat dan ketentuan.

    Referensi sumber : https://brocku.ca/webcal/2024/graduate/cosc.html

    Pelajar internasional Aturan yang berlaku

    Aturan untuk belajar di Kanada.

    Izin belajar, bukti dana, prosedur Québec, bekerja dan pilihan setelah lulus: lihat langkah, jumlah dana dan tabel dalam panduan lengkap kami.

    Panduan saat ini dalam bahasa Prancis
    Baca panduan

    Hubungi StudyCanada

    Ceritakan rencana atau pertanyaan Anda. Kita lanjutkan melalui email.

    Kami menggunakan informasi kontak ini untuk menjawab pertanyaan Anda. Privasi

    Formulir ini ditujukan kepada StudyCanada. Untuk menghubungi institusi ini, gunakan kontak pada profilnya.