000 00730nam a22002177a 4500
003 OSt
005 20260630063317.0
008 260630b |||||||| |||| 00| 0 eng d
020 _a9780262039246
040 _cSGGSCC
_dSGGSCC
050 _a006.3 R
082 _22nd
_a006.3 R
100 _aSutton, Richard S. | Barto, Andrew G.
_9323
245 _aReinforcement Learning
_bAn Introduction
_cSutton, Richard S. | Barto, Andrew G.
250 _a2nd
260 _aCambridge
_bMIT Press
_c2020
300 _axxii, 526p.
650 _aComputer Science
_9324
942 _2ddc
_cBK
999 _c59791
_d59791