OpenAI News Research & Papers · Апр 21, 2017 07:00 imp:65 Equivalence between policy gradients and soft Q-learning Откройте оригинал, чтобы прочитать статью полностью. Читать оригинал на OpenAI News →