惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园_首页
GbyAI
GbyAI
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Apple Machine Learning Research
Apple Machine Learning Research
大猫的无限游戏
大猫的无限游戏
阮一峰的网络日志
阮一峰的网络日志
Last Week in AI
Last Week in AI
V
Visual Studio Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
The Cloudflare Blog
博客园 - 【当耐特】
博客园 - 叶小钗
量子位
博客园 - 聂微东
S
SegmentFault 最新的问题
美团技术团队
Hugging Face - Blog
Hugging Face - Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
月光博客
月光博客
宝玉的分享
宝玉的分享
小众软件
小众软件
罗磊的独立博客
有赞技术团队
有赞技术团队
Stack Overflow Blog
Stack Overflow Blog

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 新电脑 brew install node 之后,一个小设置可以提升对供应链投毒的防御 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用? 做了个 AI + 真人专家监督的广告投放平台 Auxora, 7 个品牌跑出 6x ROAS
[AI 公司招聘] AI 方向工程师(北京、远程不限)
jennyluo · 2026-04-24 · via V2EX

关于 Atlas Cloud
Atlas Cloud 是一家快速发展的 AI 基础设施初创公司,专注于模型即服务( MaaS ) 和 基础设施即服务( IaaS )。
公司总部位于纽约,在硅谷、北京和加拿大卡尔加里设有团队,为全球客户提供 大语言模型( LLM )训练、微调与推理服务所需的 GPU 与云基础设施。
我们正在构建面向下一代 AI 应用的高性能计算平台。
We are hiring-
一、图视频大模型算法工程师
你的工作将包括:
1 、负责开源图视频生成模型的深度微调与二次训练,结合业务场景进行领域适配;
2 、针对推理效率瓶颈,开展模型量化、蒸馏、步数压缩(如一致性蒸馏、Flow Matching 加速)等工程优化;
3 、设计并实现动态分块推理、显存优化等长视频工程落地策略,满足在线/离线生产环境需求。
4 、持续跟踪业界先进图视频生成算法,包括但不限于数字人驱动、流式视频增强、视频修复/编辑、音视频同步等方向;
5 、对重点开源项目进行复现与效果评估,产出横向对比报告,提炼可落地的技术点;
6 、从零设计并构建图视频生成方向的算法评价集,覆盖主观质量、时序一致性、文字渲染、语义对齐等多维度;制定自动化评估 pipeline ,降低人工评测成本;
7 、将项目中的技术方案、踩坑经验、实验结论以高质量中文/英文技术博客的形式输出,发布于团队技术公众号或个人技术主页;
8 、参与开源社区建设,对内提供可复用的技术文档与 Notebook ,提升团队整体研发效率。
我们寻找这样的你:
1 、计算机、电子工程、数学或相关专业本科及以上学历,3 年以上算法工程经验;
2 、扎实的深度学习基础,熟悉 Transformer 、扩散模型( DDPM / DDIM / Flow Matching )等核心架构;
3 、熟练掌握 PyTorch ,有大规模模型训练(多机多卡 / DeepSpeed / FSDP )实战经验;
4 、有图像或视频生成相关项目落地经验(含模型微调、数据工程、推理优化中的至少一项);
5 、良好的代码质量意识,能独立设计并实现完整的训练/推理 pipeline 。
加分项( 1-2 项优先)
1 、有视频扩散模型微调经验;
2 、有强化学习后训练( RLHF / GRPO / DPO )应用于生成模型的实践经验;
3 、了解数字人生成( SadTalker / LivePortrait / Hallo 等)或流式视频增强算法;
4 、有 ControlNet 、IPAdapter 、LoRA 等条件注入方法的工程落地经验;
5 、有开源社区贡献记录( GitHub star 项目 / 技术博客 / 顶会论文);
6 、完整算法评价集设计与自动化评测 pipeline 搭建经验;
7 、有长视频推理优化(分块策略、KV Cache 复用、镜头检测集成等)工程经验。
二、AI 基础设施工程师
你的工作将包括:
1 、负责大模型推理服务在自有 GPU 集群上的全栈部署,覆盖服务发现、请求路由、推理 Worker 各组件的安装、配置与上线;
2 、 和运维同事一起管理推理集群基础设施层,包括 GPU 驱动、CUDA 工具链、高速网络互联( InfiniBand/RoCE )及存储栈的日常维护;
3 、配置并调优节点间高性能数据传输层,确保 KV cache 在跨节点 Worker 间的高效传输;
4 、搭建推理集群的完整可观测性体系,持续监控 TTFT 、ITL 、吞吐量、缓存命中率等核心指标;
5 、协同 AI 推理团队完成模型上线,支持主流开源推理引擎(覆盖 vLLM / SGLang / TensorRT-LLM )的接入、切换与版本管理;
6 、负责推理服务的容量规划与性能瓶颈分析,具备独立排查多机多卡分布式推理问题的能力。
我们寻找这样的你:
1 、3 年以上 Linux 系统后端基础设施开发经验,熟悉 Python ,golang 能独立阅读和修改工程级项目代码;
2 、 熟悉容器化技术( Docker ),熟悉 Kubernetes 各项操作;
3 、 具备 NVIDIA GPU 服务器实际运维经验,能独立完成驱动、CUDA 、NCCL 等环境搭建,能独立处理 InfiniBand / RoCE 网络环境下的 RDMA 配置问题;
4 、熟悉分布式系统基础概念:服务发现、消息队列、负载均衡;
5 、有在多机 GPU 集群上部署过至少一种分布式 LLM 推理框架的实际经验( vLLM 、SGLang 、TensorRT-LLM 等均可);
6 、具备基本的性能调优能力:能读懂 Prometheus 指标、定位推理延迟瓶颈;
加分项(具备任意一项均视为强加分)
1 、有 NVIDIA Dynamo 实际部署经验,熟悉其 disaggregated serving 、KV-aware routing 、NIXL 传输架构优化;
2 、有 prefill / decode 分离架构的分布式推理部署经验,熟悉 KV cache 感知路由机制;
3 、了解 KV cache 分层存储( GPU VRAM → CPU RAM → NVMe → 对象存储)及其性能特征;
4 、⭐ 熟悉 GPUDirect RDMA / GPUDirect Storage 等高性能 GPU 数据通路。
三、AI Agent 开发工程师 (创新原型)
你的工作将包括:
1. 快速原型实现 (MVP Execution): 根据公司战略及业务部门的创新需求,快速构建 AI Agent 或自动化工具的原型。
2. 业务需求转化: 深度理解业务逻辑,并将其转化为技术实现方案。
3. 技术探索与应用: 追踪全球最前沿的 AI 技术、开源项目及工具,并将其应用到实际开发中以提升交付效率。
4. 快速迭代优化: 基于业务反馈,对产品进行极速调整,通过技术手段不断优化工具的准确率和易用性。
我们寻找这样的你:
1. AI 赋能的开发效率 (AI-Native Developer):
- 你不需要是某个特定语言的死忠粉,但你必须是 AI Coding (如 Cursor, Claud Code, Codex 等) 的重度使用者。
- 能够熟练利用各类 AI 辅助工具进行“高并发”开发。
2. 全栈实现能力:
- 具备快速搭建前后端应用的能力(如 Python/FastAPI, Next.js/TypeScript 等)。
- 熟悉主流 Agent 开发框架(如 Dify, Coze, LangChain 等)或低代码/无代码工具。
3. 敏锐的产品感 (Product Sense):
- 能够听懂业务语言,理解“为什么要做这个”,并能主动提出比原始需求更好的技术实现方案。
4. 技术好奇心与自主学习:
- 你是新技术的早期采用者,喜欢折腾新鲜玩意儿。
5. 基础沟通与英语能力:
- 能够流畅阅读英文技术文档及社区动态( GitHub/Discord/X ),具备基础的英文交流能力。
[加分项]
- 在 GitHub 或社交媒体分享过自己独立开发的 AI 小工具或 Agent 。
- 有成功通过自动化技术解决业务问题(如爬虫、工作流自动化、数据清洗)的实战经验。
- 曾有过创业经历或在初创团队担任过核心开发者。
你将获得:
1 、具有竞争力的薪资;
2 、五险一金,节假日福利;
3 、良好的办公环境,轻松的办公氛围。
办公室地址:北京市海淀区融科资讯中心
请将您的简历发送至 jenny.luo@atlascloud.ai(标题:应聘岗位+姓名),期待您的加入!!!