惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 叶小钗
爱范儿
爱范儿
WordPress大学
WordPress大学
Last Week in AI
Last Week in AI
博客园 - 聂微东
雷峰网
雷峰网
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
博客园 - 三生石上(FineUI控件)
T
Tailwind CSS Blog
博客园 - Franky
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园_首页
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 司徒正美
月光博客
月光博客
大猫的无限游戏
大猫的无限游戏
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
The Cloudflare Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
人人都是产品经理
人人都是产品经理
宝玉的分享
宝玉的分享
罗磊的独立博客
Jina AI
Jina AI

酷工作

招大龄程序员,稳定兼职工作 生成壁纸 远程全职 AI 能效官/Aengt 架构师(AI 全栈工程师 / AI 应用工程师(全栈)/高级 AI 应用工程师(Agent Ops)/AI 流程开发工程师(Agent/自动化方向) [西安] 逆向开发工程师(Android / iOS)长期稳定 [广州外资] 招实习生/兼职| AI 自动化提效方向(龙虾 OpenClaw、爱马仕 Hermes 之类)|把重复文书工作做成一键化 远程居家 Ai 效能岗位,前后端开发,架构师 Aengt 架构师(AI 全栈工程师 / AI 应用工程师(全栈)远程 zcgs2149@gmail.com 好奇安服现在还有新岗位吗? 🌟 关于我们 CH 传媒,专注互联网内容与 AI 赋能赛道。全球远程办公,高薪诚聘英才。 联想内推机会|多岗位开放(北京/深圳/武汉/上海等) 工作 5 年以上的, 在 2026 年是怎么找&换工作的 南京软件大道岗位热招中 [杭州][北京]快手支付技术中台招聘 Java 后端 [深圳] 招聘研发 Leader、后端技术工程师(AI 券商科技) Android 逆向/行为分析方向技术合作(可长期,偏实战) [东京 IT 会社直招] PM/PL/Web 工程师|坐标文京区,我们公司正在找靠谱的 IT 伙伴,有想法进来聊聊? React Native 开发工程师(远程开发岗位) [西安]自研产品招聘嵌入式全栈工程师 [三七互娱-广州-社招] AI 平台开发工程师、资深前端开发工程师、资深测试开发工程师、高级 golang 后端开发工程师、资深 golang 开发工程师、AI 算法工程师 AI 出海明星产品 YouMind 招增长工程实习生,优秀者可转正 [成都 / Remote] [急招] Backend Engineer(Trading Platform) [北京]老虎证券内推,互聯網券商,招产品+开发+运营,欢迎优秀人才投递(~~) [内推] 上海 0→1 团队招 Backend / iOS Native - AI Native 产品 [征合作方] Tryon 多件叠穿 AI 方案 — 电商场景合作 [远程] 高级 Flutter 开发工程师 (AI 大健康) 肢体残疾 想找一个远程的 Java (或者 base 武汉 成都) 北京上海招 Agentic Engineering 工程师 [北京上海无锡]基础框架/高性能算子多个方向 朋友公司-上海 招后端架构, AI 工程师,实施经理(深圳/西安也有),产品运营 设计行业 AI 应用,找兼职 web 开发 [远程]
[招聘] AI for code 创业团队: LLM Training / Alignment/ ...
joywho · 2026-06-16 · via 酷工作

关于我们:
我们是一家专注 代码智能( Code Intelligence )与大模型训练 的 AI 创业公司。
公司由拥有 20 年强化学习与机器学习经验 的技术专家创立,已完成 2 亿元融资。
我们正在构建面向软件工程场景的新一代代码模型与 Coding Agent
核心方向包括:
1.大模型训练( Pre-training / Continued Training / SFT / Middle Training )
2.强化学习与对齐( RLHF / Preference Optimization )
3.Code LLM 训练与优化
4.Coding Agent 系统与工具调用能力
5.软件工程任务评测体系( SWE-bench 等)
我们的目标:
在真实软件工程任务中持续提升模型能力
推动 AI 从“代码辅助工具”走向“自主软件工程能力”
关于岗位:
大模型训练 / 强化学习算法工程师( LLM Training / RL )
工作内容:
1.大语言模型训练全流程设计与优化( Pre-train / Middle-train / Post-train )
2.Continued Pre-training / SFT / 对齐训练策略设计
3.Code 数据构造、清洗与训练策略优化
4.Reward Model 构建与 RLHF / RLAIF 训练流程设计
5.PPO / DPO / GRPO 等方法在实际训练中的应用
6.模型能力评测与训练闭环迭代
我们希望你:
* 对大模型训练体系( pre-train / post-train / alignment )有系统理解
* 对 Transformer 结构与训练机制有深入理解
* 参与或实际做过 LLM / Code LLM 训练或微调项目
* 参与过 RLHF / preference optimization / reward model 构建流程
* 能在 PPO / DPO / GRPO 等方法中解决实际模型优化问题
加分项:
* 深度参与过大规模 LLM 训练或优化(非 API 使用)
* 有模型稳定性优化 / 数据构造 / 训练策略优化经验
* 有 benchmark / evaluation system 构建经验
* 有论文 / 开源项目 / 技术报告成果
我们欢迎:
* 有国内头部 AI 大模型团队研发经验(如阿里、字节、腾讯等)
* 高校优秀研究者
* 应届博士(强化学习、机器学习、大模型方向)
* 有 NeurIPS / ICML / ICLR / ACL 等顶会论文或研究成果者
我们希望找到能够将前沿研究方法真正转化为模型能力提升的人。
我们提供:
* 有竞争力薪资 + 早期核心成员期权
* 充足 GPU 算力支持快速实验
* 小团队、高自由度技术环境
* 直接参与模型方向与技术路线设计
* 与资深 RL / LLM 研究者共同从 0 到 1 构建系统
办公地点:
北京 / 上海 / 深圳(任选)
投递邮箱:
joy_ss@foxmail.com