000 00387nam a2200169Ia 4500
008 260109s9999||||xx |||||||||||||| ||und||
020 _a9780262039246
035 _a111
082 _a006.3
_BSUT
100 _aSutton, Richard S.; Barto, Andrew G.
245 0 _aReinforcement Learning
250 _a2
260 _bMIT Press
_c2018
300 _a526
500 _a1780
942 _cBK
999 _c27055
_d27055