Brock University · COSC 5P83

Takviyeli Öğrenme

Resmi başlık : Reinforcement Learning

Kredi : 0.5Referans yılı : 2024-25

Bu referans belirtilen kataloğu tanımlar. Güncel teklifi ve başlangıç için geçerli koşulları doğrulamak üzere kuruma başvurun.

Açıklama

Pekiştirmeli Öğrenme (ayrıca COSC 4P83 olarak da sunulur) Çok kollu banditler, Markov karar süreçleri, model tabanlı ve model-özgür yöntemler (dinamik programlama, Monte Carlo yöntemleri ve zamana-bağlı fark yöntemleri gibi) dahil temel pekiştirmeli öğrenme kavramlarına giriş; değer ve politika fonksiyonlarının öğrenilmesi. Derin pekiştirmeli öğrenme dahil yaklaşımların yaklaşık çözümleri.

Kaynak metin orijinal dilinde

Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.

    Kaynaklar ve referanslar

    Tarih ve kaynaklar bilgileri doğrulamanıza yardımcı olmak için saklanır. Okumayı kolaylaştırmak için çeviriler sunulmuştur; koşullar ve gereksinimler için resmi kaynak esas alınır.

    Kaynak referans : https://brocku.ca/webcal/2024/graduate/cosc.html

    StudyCanada’ya yazın

    Planınızı veya sorunuzu paylaşın. Görüşmeye e-postayla devam edelim.

    Bu iletişim bilgilerini sorunuza yanıt vermek için kullanacağız. Gizlilik

    Bu form StudyCanada’ya gönderilir. Okulla iletişime geçmek için okul profilindeki bilgileri kullanın.