TY - RPRT TI - Temporally distinct reward and action prediction error signals during value learning and habit formation AU - Wang, Y. AU - Burgeno, L. AU - Cerpa, J. C. AU - Manohar, S. AU - Bogacz, R. AU - Walton, M. E. PY - 2026 DO - 10.64898/2026.08.19.745693 UR - https://www.biorxiv.org/content/10.64898/2026.08.19.745693v1 ID - 10.64898/2026.08.19.745693 ER -