AI 뉴스로 돌아가기

Learning to summarize with human feedback

We’ve applied reinforcement learning from human feedback to train language models that are better at summarization.

2020.09.0411원문 보기
We’ve applied reinforcement learning from human feedback to train language models that are better at summarization.