Batch Reinforcement Learning2012-01-010 PRE AI DOI:10.1007/978-3-642-27645-3_2OriginalOriginal request for helpShareSaveAbstract En