跳到正文

MarkTechPost

网站与博客 · 历史来源 · 当前未持续收录

当前显示全部 AI 相关新闻
切换来源
99 条AI 相关新闻 · 最新在前
8月20日周四
  1. MarkTechPost46

    用 TRL 和 LoRA 在 Anthropic HH-RLHF 上做 DPO 偏好审计与微调教程

    一篇教程用 Anthropic HH-RLHF 数据集和 DPO 搭建端到端偏好学习流程,先审计数据集的结构与长度偏好偏差,并用词法捷径诊断判断表层语言模式能否区分优选与拒绝回答。随后基于 TRL 和可选 LoRA 构建版本鲁棒的 DPO 训练管线,微调 Qwen2.5-0.5B-Instruct,评估 reward accuracy 与训练行为,并分析各 HH-RLHF 子集表现和潜在长度偏差。

8月19日周三
8月18日周二
8月17日周一
8月15日周六
8月14日周五
8月13日周四
8月12日周三