CAN TEMPORAL-DIFFERENCE AND Q-LEARNING LEARN REPRESENTATION? A MEAN-FIELD THEORY

Gespeichert in:
Bibliographische Detailangaben
Veröffentlicht in:NeurIPS (34. : 2020 : Online) 34th Conference on Neural Information Processing Systems (NeurIPS 2020) ; Volume 24 of 27
1. Verfasser: Zhang, Yufeng (VerfasserIn)
Weitere Verfasser: Cai, Oi (VerfasserIn), Yang, Zhuoran (VerfasserIn), Chen, Yongxin (VerfasserIn), Wang, Zhaoran (VerfasserIn)
Pages:34
Format: UnknownFormat
Sprache:eng
Veröffentlicht: 2021
Schlagworte:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
Beschreibung
Keine Beschreibung verfügbar.