On the Convergence of Projective-Simulation–based Reinforcement Learning in Markov Decision Processes | AMiner