济州书法教育中心

人工智能 ·
首页 / 文章列表 (第 1 / 1 页 · 共 1 篇)

标签:SFT和RLHF先做哪个

  • SFT与RLHF:先选哪个,关键在于需求与场景
    SFT(Supervised Fine-tuning)即监督微调,是针对预训练语言模型进行的一种微调方法。它通过在特定任务上添加监督信号,使得预训练模型在特定任务上获得更好的表现。
    2026-07-17
1
友情链接: 北京房科技有限公司四川省会东县物业管理有限公司咨询有限公司河南机器有限公司