Cine este Richard Sutton
Richard S. Sutton este unul dintre fondatorii reinforcement learning (RL) modern, profesor titular la University of Alberta (Edmonton, Canada) și fost cercetător principal la Google DeepMind (2017-2023). Co-autor al manualului canonic "Reinforcement Learning: An Introduction" (cu Andrew Barto, prima ediție 1998, a doua 2018), considerat textbook-ul standard al domeniului. Laureat al ACM Turing Award 2024 împreună cu Barto pentru "dezvoltarea fundamentelor conceptuale și algoritmice ale reinforcement learning". Autor al influentei eseuri "The Bitter Lesson" (2019).
Date personale și parcurs academic
Născut în 1957 în Statele Unite. Bachelor of Arts în psihologie la Stanford University (1978). Doctorat (Ph.D.) în computer science la University of Massachusetts Amherst (1984) sub coordonarea lui Andrew Barto — colaborare începută în anii doctoratului care a continuat patru decenii. Cetățenie americană și canadiană (după mutarea permanentă la Edmonton).
Parcursul profesional
- 1985-1994 — cercetător la GTE Laboratories (Waltham, Massachusetts), unde dezvoltă algoritmii temporal-difference learning
- 1995-1998 — Senior Research Scientist la University of Massachusetts Amherst
- 1998-2002 — Principal Technical Staff Member la AT&T Shannon Laboratory
- 2003-prezent — profesor titular la University of Alberta, fondator al laboratorului Reinforcement Learning and Artificial Intelligence (RLAI)
- 2017-2023 — Distinguished Research Scientist la Google DeepMind (filiala Alberta deschisă explicit pentru a-l recruta, alături de Michael Bowling și Patrick Pilarski)
- 2024-prezent — Chief Scientific Advisor la Keen Technologies (compania lui John Carmack dedicată AGI)
Contribuții fundamentale: algoritmul TD-learning (temporal-difference, baza tuturor RL modern), arhitectura actor-critic, policy gradient methods, Dyna architecture (model-based RL). Eseul "The Bitter Lesson" (2019) argumentează că în 70 de ani de AI, singurele metode care au scalat sunt cele bazate pe căutare și învățare exploatând compute, nu cele care încorporează cunoștințe umane structurate — teză adoptată ca dogmă în era LLM-urilor.
Întrebări frecvente
Cine este Richard Sutton? Profesor University of Alberta, părintele reinforcement learning modern. Laureat Turing Award 2024 împreună cu Andrew Barto.
Pentru ce a primit Turing Award? ACM Turing Award 2024 (anunțat martie 2025) împreună cu Andrew Barto pentru fundamentele conceptuale și algoritmice ale reinforcement learning.
Ce este "The Bitter Lesson"? Eseu publicat de Sutton în martie 2019, argumentând că singurele metode AI care au scalat în 70 de ani sunt cele bazate pe căutare și învățare cu compute masiv, nu cele care folosesc cunoștințe umane structurate.
A lucrat Sutton la DeepMind? Da, între 2017 și 2023 ca Distinguished Research Scientist. DeepMind a deschis explicit un birou la Edmonton pentru a-l recruta. A plecat în 2023 pentru a se concentra pe cercetarea AGI la Keen Technologies (John Carmack).
Ce universitate? University of Alberta din 2003. Conduce laboratorul RLAI (Reinforcement Learning and Artificial Intelligence).
Care este manualul lui? "Reinforcement Learning: An Introduction" (cu Andrew Barto). Prima ediție 1998, a doua ediție 2018. Textbook canonic al domeniului, peste 80 000 citări Google Scholar.
Cu cine colaborează în prezent? Andrew Barto (co-autor istoric), Michael Bowling (Alberta), Patrick Pilarski (Alberta). La Keen Technologies lucrează direct cu John Carmack pe arhitecturi AGI.