Asymmetric actor critic for image-based robot learning
Explorar
Noticias de IA
30934 elementos — filtrados, clasificados y sin duplicados
Domain randomization and generative models for robotic grasping
Meta-learning for wrestling
Competitive self-play
Nonlinear computation in deep linear networks
Learning to model other minds
Learning with opponent-learning awareness
OpenAI Baselines: ACKTR & A2C
More on Dota 2
Dota 2
Gathering human feedback
Better exploration with parameter noise
Proximal Policy Optimization
Robust adversarial inputs
Hindsight Experience Replay
Teacher–student curriculum learning
Faster physics in Python
Learning from human preferences
Learning to cooperate, compete, and communicate
UCB exploration via Q-ensembles
OpenAI Baselines: DQN
Robots that learn
Roboschool
Equivalence between policy gradients and soft Q-learning
Stochastic Neural Networks for hierarchical reinforcement learning
Unsupervised sentiment neuron
Spam detection in the physical world
Evolution strategies as a scalable alternative to reinforcement learning
One-shot imitation learning
Distill