هذا المرجع يصف الكتالوج المشار إليه. راجع المؤسسة لتأكيد العرض الحالي والشروط المطبقة على فصلك الدراسي.
الوصف
التعلم التعزيزي (يُقدَّم أيضاً كـ COSC 4P83) مقدمة لمفاهيم التعلم التعزيزي الأساسية بما في ذلك العصابات متعددة الذراعين، عمليات اتخاذ القرار ماركوف، الطرق المبنية على النموذج والطرق غير المبنية على النموذج (مثل البرمجة الديناميكية، طرق مونت كارلو، وطرق الفارق الزمني) لتعلم وظائف القيمة والسياسة. حلول التقريب بما في ذلك التعلم التعزيزي العميق.
نص المرجع بلغته الأصلية
Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.
المصادر والمراجع
يتم الاحتفاظ بالتواريخ والمصادر لمساعدتك في التحقق من المعلومات. تُعرض ترجمات لتسهيل القراءة؛ المصدر الرسمي هو المرجع للشروط والمتطلبات.
مرجع المصدر : https://brocku.ca/webcal/2024/graduate/cosc.html