OpenAI News Research & Papers · Mar 20, 2018 07:00 imp:45 Variance reduction for policy gradient with action-dependent factorized baselines Open the original source for the full article. Read original at OpenAI News →