OpenAI News Research & Papers · Oct 19, 2022 07:00 imp:65 Scaling laws for reward model overoptimization Abre la fuente original para leer el artículo completo. Leer el original en OpenAI News →