我本来不想使出这一招的
—— 面向大语言模型对齐的偏好建模、训练范式与前沿进展 —— 研究课题:奖励模型(Reward Modeling) 文献范围:2022 — 2025 年(侧重近一年) 文献类型:...
只显示最新10条未读和已读信息
登录 | SIGN IN