我们提出一种基于强化学习的大型语言模型微调方法,该方法使用实体幻觉指数(Enti Hallucination Index, EHI)作为奖励信号,以减少文本摘要中的实体级别幻觉。在会议记录上的实验表明,该方法可提高实体的忠实性和准确性。
Chapters in this video
0:00
Introduction
0:24
Fine-Tuning Large Language Models
2:43
Results
3:37
Conclusion
Related Videos
版权所有 © 2026 MyJoVE Corporation。保留所有权利。