


















本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容: 我的帖子已经打上 <span class="hashtag-icon-placeholder"></span>开源推广</span> 标签: 是 我的开源项目完整开源,无未开源部分: 是 我的开源项目已链接认可 LINUX DO 社区: 是 我帖子内的项目介绍,AI生成、润色内容部分已截图发出: 是 以上选择我承诺是永久有效的,接受社区和佬友监督: 是 DomainPostTrain (代码仓库) 是一个通用领域后训练管道示例,用于把静态领域文档、事实问答样例和偏好样例组织成可复现的 LLM 后训练流程: CPT → Fact-SFT → optional DPO → merge → quality eval → inference/export 本仓库只包含静态 mock 数据。示例领域是 `AsterHelp`,一个虚构的内部支持知识库助手。训练真实模型前,请替换为你拥有合法使用权的领域文档、SFT 样例、DPO 偏好样例和质量评估题集。 ### 能力范围 - CPT 语料发现、语料安全预检、必覆盖数据集构造和覆盖报告。 - PEFT LoRA/QLoRA 领域继续预训练式适配。 - Fact-SF...
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。