Denne referansen beskriver den angitte katalogen. Kontakt institusjonen for å bekrefte gjeldende tilbud og betingelser som gjelder for din start.
Beskrivelse
Forsterkningslæring (tilbys også som COSC 4P83) Innføring i grunnleggende konsepter i forsterkningslæring inkludert multi-armed bandits, Markov decision processes, modellbaserte og modellfrie metoder (som dynamisk programmering, Monte Carlo-metoder og tidsdifferansemetoder) for å lære verdifunksjoner og policyer. Approksimasjonsløsninger inkludert dyp forsterkningslæring.
Referansetekst i originalspråket
Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.
Kilder og referanser
Datoer og kilder beholdes for å hjelpe deg å verifisere opplysningene. Oversettelsene tilbys for å lette lesing; den offisielle kilden er referansen for krav og betingelser.
Kildereferanse : https://brocku.ca/webcal/2024/graduate/cosc.html