OpenAI News Research & Papers · Сен 4, 2020 07:00 imp:65 Learning to summarize with human feedback We’ve applied reinforcement learning from human feedback to train language models that are better at summarization. Читать оригинал на OpenAI News →