人类反馈强化学习在法律大语言模型中的应用综述
李天赐, 方亦圆, 金孙伟, 奚雪峰, 朱润, 盛胜利, 崔志明, 王坚
A Review Of The Application Of Human Feedback Reinforcement Learning In Legal Large Language Model
LI Tianci, FANG Yiyuan, JIN Sunwei, XI Xuefeng, ZHU Run, SHENG Shengli, CUI Zhiming, WANG Jian
计算机工程
.
0, (): 0
-0
.
DOI: 10.19678/j.issn.1000-3428.0260290