TY - RPRT TI - Optimal Reward Functions in Distributed Reinforcement Learning AU - Wolpert, David H. AU - Tumer, Kagan PY - 2000 UR - https://ntrs.nasa.gov/citations/20010066523 ID - 20010066523 ER -