新闻 · OpenAI News Learning to summarize with human feedback We’ve applied reinforcement learning from human feedback to train language models that are better at summarization. en 发布: 2020-09-04 查看来源 ↗ 返回新闻列表