OpenAI News·· 2020-09-04精选AI 评分63
OpenAI 利用人类反馈强化学习提升模型摘要能力
Learning to summarize with human feedback
AI 导读
OpenAI 应用基于人类反馈的强化学习(RLHF)训练语言模型,以提升模型在文本摘要任务上的表现。
来源:OpenAI News · openai.com
Learning to summarize with human feedback
OpenAI 应用基于人类反馈的强化学习(RLHF)训练语言模型,以提升模型在文本摘要任务上的表现。
来源:OpenAI News · openai.com