AI热词解释列表,浏览热门 AI 名词解释、使用场景和相关概念延伸内容

面包屑图标 当前位置: 首页
AI热词解释

AI 热词解释

输入一个 AI 名词,快速查看通俗解释和相关概念。

Reward Model(奖励模型)是强化学习中用来评估AI行为好坏的评分系统。在大模型训练中,它把人类偏好转化为分数,指导模型生成更符合预期的内容,是RLHF的核心组件。

最新解释

正在生成解释

正在处理 AI 热词,请稍候...