济州书法教育中心
人工智能 ·
首页
业务领域
关于我们
标签
新闻资讯
首页
/ 文章列表 (第 1 / 1 页 · 共 1 篇)
标签:SFT和RLHF先做哪个
SFT与RLHF:先选哪个,关键在于需求与场景
SFT(Supervised Fine-tuning)即监督微调,是针对预训练语言模型进行的一种微调方法。它通过在特定任务上添加监督信号,使得预训练模型在特定任务上获得更好的表现。
2026-07-17
1
友情链接:
北京房科技有限公司
四川省会东县物业管理有限公司
咨询有限公司
河南机器有限公司