| 000 | 00730nam a22002177a 4500 | ||
|---|---|---|---|
| 003 | OSt | ||
| 005 | 20260630063317.0 | ||
| 008 | 260630b |||||||| |||| 00| 0 eng d | ||
| 020 | _a9780262039246 | ||
| 040 |
_cSGGSCC _dSGGSCC |
||
| 050 | _a006.3 R | ||
| 082 |
_22nd _a006.3 R |
||
| 100 |
_aSutton, Richard S. | Barto, Andrew G. _9323 |
||
| 245 |
_aReinforcement Learning _bAn Introduction _cSutton, Richard S. | Barto, Andrew G. |
||
| 250 | _a2nd | ||
| 260 |
_aCambridge _bMIT Press _c2020 |
||
| 300 | _axxii, 526p. | ||
| 650 |
_aComputer Science _9324 |
||
| 942 |
_2ddc _cBK |
||
| 999 |
_c59791 _d59791 |
||