OpenAI News Research & Papers · Sep 4, 2020 07:00 imp:65 Learning to summarize with human feedback We’ve applied reinforcement learning from human feedback to train language models that are better at summarization. Read original at OpenAI News →