还有问题想知道答案……但我已经是看过最多星星的一只兔子了!
—— 面向大语言模型对齐的偏好建模、训练范式与前沿进展 —— 研究课题:奖励模型(Reward Modeling) 文献范围:2022 — 2025 年(侧重近一年) 文献类型:...
只显示最新10条未读和已读信息
登录 | SIGN IN