惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

有赞技术团队
有赞技术团队
G
Google Developers Blog
T
Tailwind CSS Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
人人都是产品经理
人人都是产品经理
J
Java Code Geeks
P
Proofpoint News Feed
V
Visual Studio Blog
爱范儿
爱范儿
The Cloudflare Blog
博客园 - 叶小钗
V
V2EX
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
M
MIT News - Artificial intelligence
Microsoft Security Blog
Microsoft Security Blog
博客园 - 聂微东
H
Help Net Security
B
Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 【当耐特】
量子位
宝玉的分享
宝玉的分享
WordPress大学
WordPress大学
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知

酷工作

招大龄程序员,稳定兼职工作 生成壁纸 远程全职 AI 能效官/Aengt 架构师(AI 全栈工程师 / AI 应用工程师(全栈)/高级 AI 应用工程师(Agent Ops)/AI 流程开发工程师(Agent/自动化方向) [西安] 逆向开发工程师(Android / iOS)长期稳定 [广州外资] 招实习生/兼职| AI 自动化提效方向(龙虾 OpenClaw、爱马仕 Hermes 之类)|把重复文书工作做成一键化 远程居家 Ai 效能岗位,前后端开发,架构师 Aengt 架构师(AI 全栈工程师 / AI 应用工程师(全栈)远程 zcgs2149@gmail.com 好奇安服现在还有新岗位吗? 🌟 关于我们 CH 传媒,专注互联网内容与 AI 赋能赛道。全球远程办公,高薪诚聘英才。 联想内推机会|多岗位开放(北京/深圳/武汉/上海等) 工作 5 年以上的, 在 2026 年是怎么找&换工作的 南京软件大道岗位热招中 [杭州][北京]快手支付技术中台招聘 Java 后端 [深圳] 招聘研发 Leader、后端技术工程师(AI 券商科技) Android 逆向/行为分析方向技术合作(可长期,偏实战) [东京 IT 会社直招] PM/PL/Web 工程师|坐标文京区,我们公司正在找靠谱的 IT 伙伴,有想法进来聊聊? React Native 开发工程师(远程开发岗位) [西安]自研产品招聘嵌入式全栈工程师 [三七互娱-广州-社招] AI 平台开发工程师、资深前端开发工程师、资深测试开发工程师、高级 golang 后端开发工程师、资深 golang 开发工程师、AI 算法工程师 AI 出海明星产品 YouMind 招增长工程实习生,优秀者可转正 [成都 / Remote] [急招] Backend Engineer(Trading Platform) [北京]老虎证券内推,互聯網券商,招产品+开发+运营,欢迎优秀人才投递(~~) [内推] 上海 0→1 团队招 Backend / iOS Native - AI Native 产品 [征合作方] Tryon 多件叠穿 AI 方案 — 电商场景合作 [远程] 高级 Flutter 开发工程师 (AI 大健康) 肢体残疾 想找一个远程的 Java (或者 base 武汉 成都) 北京上海招 Agentic Engineering 工程师 [北京上海无锡]基础框架/高性能算子多个方向 朋友公司-上海 招后端架构, AI 工程师,实施经理(深圳/西安也有),产品运营 设计行业 AI 应用,找兼职 web 开发 [远程]
招聘:对话模型训练工程师
yjpeminem0604 · 2026-06-25 · via 酷工作

我们是初创的美国华人公司,目前专属在 NSFW 领域的对话产品

希望在专属小参数模型方面能够找到牛人助力,工作方式为远程全职,或顾问参与皆可

欢迎各位大牛联系

岗位职责

负责专有小参数对话模型的部署、训练全流程:数据工程、SFT 、DPO 、LoRA 主导训练数据的清洗、构建、去重与配比(覆盖不同角色类型与内容强度分级) 基于平台用户偏好信号搭建 DPO 偏好飞轮,把行为数据转化为训练数据 设计并维护独立的评估体系:评估维度标准化、评测集与训练集严格隔离、内置多样性指标防止 DPO 同质化坍塌 在 RTX 5080 本地 / RunPod / Vast.ai 云端完成训练与调参

任职要求

1 年以上 ML / 模型训练经验,有完整跑通 SFT + DPO 的实战案例 精通 LoRA / QLoRA 、SFT 、DPO ,熟悉 HuggingFace TRL ( DPOTrainer ) 熟练至少一个训练框架:LLaMA-Factory / Axolotl / 阿里 Swift / Unsloth 具备扎实的数据工程能力(数据是训练 ~70% 的工作量,质量优先于数量) 熟悉 Qwen 系列等基座模型,理解 SFT-before-DPO 的训练序列 理解 DPO 谄媚坍塌、教师模型天花板、蒸馏数据分布缺口等风险并能规避 对 NSFW / 成人向数据无心理排斥 接受离岸结构与远程全职

加分项

有角色扮演 / NSFW 方向的模型微调实战 有从用户行为信号构建偏好数据集的经验 熟悉 Triton 、推理优化,能兼顾训练与部署

联系邮箱( Base64 ):cGVhY2hsYW5kYWlAZ21haWwuY29t

联系 VX ( Base64 ):QzU3OTY4MDA=

联系 TG ( Base64 ):QGN6YWs5