Brock University · COSC 5P83

Forsterkningslæring

Offisiell tittel : Reinforcement Learning

Studiepoeng : 0.5Referanseår : 2024-25

Denne referansen beskriver den angitte katalogen. Kontakt institusjonen for å bekrefte gjeldende tilbud og betingelser som gjelder for din start.

Beskrivelse

Forsterkningslæring (tilbys også som COSC 4P83) Innføring i grunnleggende konsepter i forsterkningslæring inkludert multi-armed bandits, Markov decision processes, modellbaserte og modellfrie metoder (som dynamisk programmering, Monte Carlo-metoder og tidsdifferansemetoder) for å lære verdifunksjoner og policyer. Approksimasjonsløsninger inkludert dyp forsterkningslæring.

Referansetekst i originalspråket

Reinforcement Learning (also offered as COSC 4P83) Introduction to fundamental reinforcement learning concepts including multi-armed bandits, Markov decision processes, model-based and model-free methods (such as dynamic programming, Monte Carlo methods, and temporal-difference methods) for learning value and policy functions. Approximation solutions including deep reinforcement learning.

    Kilder og referanser

    Datoer og kilder beholdes for å hjelpe deg å verifisere opplysningene. Oversettelsene tilbys for å lette lesing; den offisielle kilden er referansen for krav og betingelser.

    Kildereferanse : https://brocku.ca/webcal/2024/graduate/cosc.html

    Skriv til StudyCanada

    Fortell om planene dine eller still et spørsmål. Vi fortsetter på e-post.

    Vi bruker kontaktopplysningene til å svare på henvendelsen din. Personvern

    Dette skjemaet sendes til StudyCanada. For å kontakte skolen, bruk kontaktopplysningene i skoleprofilen.