Richard Sutton

From Wikipedia, the free encyclopedia

Richard Sutton est un informaticien canadien, professeur d'informatique à l'université de l'Alberta. Il est reconnu comme l'un des fondateurs de l'apprentissage par renforcement, domaine auquel il a apporté plusieurs contributions majeures telles que le temporal difference learning et les méthodes de gradient[1].

Sutton reçoit son B.A. en psychologie à l'université Stanford en 1978, et ses M.Sc. et Ph.D en informatique à l'université du Massachusetts à Amherst en 1980 et 1984, sous la direction d'Andrew Barto. Sa thèse, « Temporal Credit Assignment in Reinforcement Learning », introduisait en particulier des idées de temporal difference learning.

Distinctions

Il est lauréat du prix Turing 2024[2].

Publications

Références

Liens externes

Related Articles

Wikiwand AI