Amazon Science Research & Papers · May 26, 2026 15:17 imp:50 Diverse reasoning traces teach LLMs to make better decisions How to train language models to generate diverse, accurate reasoning paths using tokens that control distinct reasoning strategies. Leer el original en Amazon Science →