OpenAI News Research & Papers · Mar 20, 2018 07:00 imp:45 Variance reduction for policy gradient with action-dependent factorized baselines Abre la fuente original para leer el artículo completo. Leer el original en OpenAI News →