跳至内容
学习新闻工具职位使命
捐赠
从这里开始开始学习
学习
前往 学习课程指南AI 导师提示库测验认证术语表
新闻
前往 新闻最新人工智能新闻主题跟踪器研究和数据集博客编辑准则更正说明
工具
前往 工具工具目录最佳名单比较工具成本计算器快速精炼机提交工具
职位
前往 职位浏览人工智能职位发布职位赞助美亚保险
使命
前往 使命使命影响和统计作者帮助中心有什么新消息支持
捐赠
首页/词汇表/培训后
人工智能术语

什么是 培训后?

定义

预训练后应用的训练步骤,例如指令调整、偏好优化和安全调整。

相关术语

DPO(直接偏好优化)
一种直接在偏好对上微调模型的训练方法,无需单独的奖励模型。
训练中期
预训练和训练后之间的中间训练阶段,通常用于能力或领域调整。
参数高效微调 (PEFT)
通过训练一小部分添加参数来调整模型的方法。
预训练
在下游适应之前对广泛数据进行初始大规模模型训练。
评估集
用于测量训练后模型质量的保留数据集。
微调
对特定领域的数据进行持续训练,以使预先训练的模型适应特定任务。

在我们的免费指南中了解更多信息

AI TrainingPseudo-Labeling and Self-TrainingELECTRA PretrainingRoBERTa Training Recipe

参见

Self-PlayWatermarkingRAG-FusionCitationsMulti-Query RetrievalFactualityParent-Document RetrievalGSM8K
PreviousMid-trainingNextSelf-Play
浏览完整的人工智能术语表探索所有免费的人工智能指南
AI Understanding

免费人工智能教育。 对于每个人、任何地方。

AI教育保持免费。一个 501(c)(3) 非营利组织,向公众教授人工智能如何实际工作以及如何很好地使用它。

开始免费学习支持我们的使命
一点清晰度。在您的收件箱中。

没有垃圾邮件。一键取消订阅。隐私政策

学习

  • 课程
  • 全部指南
  • 什么是人工智能
  • ChatGPT 与大语言模型
  • Prompt Engineering
  • 生成式 AI
  • AI 图像生成
  • AI 伦理
  • AI 的未来
  • 词汇表
  • 测验
  • 认证

资源

  • 新闻
  • 博客
  • 邮件订阅
  • AI 工具目录
  • 工具对比
  • 人工智能成本计算器
  • 提示库
  • 人工智能就业委员会
  • AI 数据统计
  • 研究和数据集
  • 提交工具

关于机构

  • 使命
  • 编辑准则
  • 更正说明
  • 赞助
  • 捐赠
  • 帮助中心
  • 什么是新的
  • 联系我们
  • 反馈问题

法律条款

  • 安全
  • 隐私政策
  • Cookie 政策
  • 使用条款
  • 信息披露
  • 捐赠人政策
  • 所有合法页面
  • 网站地图

账户

  • 登录
  • 注册
  • 提交工具
  • 服务状态501(c)(3) 公共慈善机构在法律允许的范围内,捐款在美国可以免税。
  • EIN41-3273048IRS 雇主识别号。
  • 访问开放获取核心学习没有广告,也没有付费墙。
  • 联系我们[email protected]问题、更正和新闻。

© 2026 AI Understanding. 保留所有权利。

编辑准则更正说明资金与披露联系我们