Bu referans belirtilen kataloğu tanımlar. Güncel teklifi ve başlangıç için geçerli koşulları doğrulamak üzere kuruma başvurun.
Açıklama
Pekiştirmeli Öğrenme (ayrıca COSC 4P83 olarak da sunulur) Çok kollu banditler, Markov karar süreçleri, model tabanlı ve model-özgür yöntemler (dinamik programlama, Monte Carlo yöntemleri ve zamana-bağlı fark yöntemleri gibi) dahil temel pekiştirmeli öğrenme kavramlarına giriş; değer ve politika fonksiyonlarının öğrenilmesi. Derin pekiştirmeli öğrenme dahil yaklaşımların yaklaşık çözümleri.
Kaynak metin orijinal dilinde
Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.
Kaynaklar ve referanslar
Tarih ve kaynaklar bilgileri doğrulamanıza yardımcı olmak için saklanır. Okumayı kolaylaştırmak için çeviriler sunulmuştur; koşullar ve gereksinimler için resmi kaynak esas alınır.
Kaynak referans : https://brocku.ca/webcal/2024/graduate/cosc.html