OpenAI News Research & Papers · Мар 20, 2018 07:00 imp:45 Variance reduction for policy gradient with action-dependent factorized baselines Откройте оригинал, чтобы прочитать статью полностью. Читать оригинал на OpenAI News →