惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

宝玉的分享
宝玉的分享
B
Blog RSS Feed
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
MyScale Blog
MyScale Blog
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
S
SegmentFault 最新的问题
Y
Y Combinator Blog
月光博客
月光博客
IT之家
IT之家
T
Tailwind CSS Blog
Last Week in AI
Last Week in AI
L
LangChain Blog
博客园_首页
MongoDB | Blog
MongoDB | Blog
P
Proofpoint News Feed
博客园 - Franky
WordPress大学
WordPress大学
云风的 BLOG
云风的 BLOG
M
MIT News - Artificial intelligence
V
Visual Studio Blog
小众软件
小众软件
博客园 - 叶小钗
博客园 - 三生石上(FineUI控件)
N
Netflix TechBlog - Medium

酷工作

海外抖音 Tiktok 运营 (远程岗位) 招大龄程序员,稳定兼职工作 生成壁纸 远程全职 AI 能效官/Aengt 架构师(AI 全栈工程师 / AI 应用工程师(全栈)/高级 AI 应用工程师(Agent Ops)/AI 流程开发工程师(Agent/自动化方向) [西安] 逆向开发工程师(Android / iOS)长期稳定 [广州外资] 招实习生/兼职| AI 自动化提效方向(龙虾 OpenClaw、爱马仕 Hermes 之类)|把重复文书工作做成一键化 远程居家 Ai 效能岗位,前后端开发,架构师 Aengt 架构师(AI 全栈工程师 / AI 应用工程师(全栈)远程 zcgs2149@gmail.com 好奇安服现在还有新岗位吗? 🌟 关于我们 CH 传媒,专注互联网内容与 AI 赋能赛道。全球远程办公,高薪诚聘英才。 联想内推机会|多岗位开放(北京/深圳/武汉/上海等) 工作 5 年以上的, 在 2026 年是怎么找&换工作的 南京软件大道岗位热招中 [杭州][北京]快手支付技术中台招聘 Java 后端 [深圳] 招聘研发 Leader、后端技术工程师(AI 券商科技) Android 逆向/行为分析方向技术合作(可长期,偏实战) [东京 IT 会社直招] PM/PL/Web 工程师|坐标文京区,我们公司正在找靠谱的 IT 伙伴,有想法进来聊聊? React Native 开发工程师(远程开发岗位) [西安]自研产品招聘嵌入式全栈工程师 [三七互娱-广州-社招] AI 平台开发工程师、资深前端开发工程师、资深测试开发工程师、高级 golang 后端开发工程师、资深 golang 开发工程师、AI 算法工程师 AI 出海明星产品 YouMind 招增长工程实习生,优秀者可转正 [成都 / Remote] [急招] Backend Engineer(Trading Platform) [北京]老虎证券内推,互聯網券商,招产品+开发+运营,欢迎优秀人才投递(~~) [内推] 上海 0→1 团队招 Backend / iOS Native - AI Native 产品 [征合作方] Tryon 多件叠穿 AI 方案 — 电商场景合作 [远程] 高级 Flutter 开发工程师 (AI 大健康) 肢体残疾 想找一个远程的 Java (或者 base 武汉 成都) 北京上海招 Agentic Engineering 工程师 [北京上海无锡]基础框架/高性能算子多个方向 朋友公司-上海 招后端架构, AI 工程师,实施经理(深圳/西安也有),产品运营
阿里云/ATH-容器 AI Infra-2027 届暑期实习/阿里星招聘
saintube · 2026-04-16 · via 酷工作

一年一度的实习招聘启动啦,今年招收容器调度、AI Infra 相关的以下 2 个岗位,HC 目前充足,欢迎交流~

阿里云/ATH-AI Infra 工程师-容器方向

岗位职责

你将成为大模型技术落地的“算力内核设计者”。你将深入 Kubernetes 生态,参与构建支撑超大规模 AI 集群的容器化基础设施,通过对调度、存储、网络等核心组件的深度定制与优化,打破大模型训练与推理的工程瓶颈。你的代码将直接优化 Agent 的冷启动速度,提升 GPU 集群的吞吐量与资源利用率,为 AI 时代的算力底座注入极致性能。

具体的职责包括以下相关方向的一项或多项:

  1. AI 容器调度与编排优化:
  • 深度优化 Kubernetes 调度器,实现面向 GPU 拓扑感知的算力分配,解决大规模分布式训练任务的资源碎裂问题。
  • 设计并实现面向 AI Agent 的弹性调度策略,通过多级缓存、预加载等手段,实现分钟级到秒级的 Agent 快速拉起与自动伸缩。
  1. AI 高性能存储与网络底座:
  • 针对 AI 大规模 checkpoint 与数据读取场景,优化容器存储挂载性能,通过存储卸载与并行化技术,解决分布式训练中的 I/O 阻塞问题。
  • 优化容器网络性能(如 RDMA/RoCE 深度集成),通过内核态路径优化,降低推理请求的网络传输延迟。
  1. AI 工程平台架构设计与效率提升:
  • 负责大型 AI 项目工程平台的架构设计与规划,通过构建标准化的云原生技术底座,确保复杂计算场景下的系统高可用性与可扩展性。
  • 针对大规模 AI 任务执行过程中的痛点进行架构级优化,通过降低系统开销与资源冗余,显著提升系统运行效率。
  • 定义面向 AI 场景的资源管控标准与作业管理规范,解决大规模并行任务下的资源争抢与隔离难题,确保高负载生产环境的稳定性。
  1. AI 基础设施极致加速:
  • 研发面向 AI 推理与 Agent 运行的轻量化容器运行时,实现计算资源的极致弹性与高密部署。
  • 构建 AI 场景下的监控与调优平台,深度剖析容器化环境下的性能瓶颈,实现从底层硬件到应用层的全链路性能优化。
  • 负责容器镜像基础服务设计与研发,针对 AI 业务特征及需求,深度优化产品架构及技术实现,为 AI 业务大规模使用等场景提供高效极致的产品能力。
  • 设计研发基于 AI 的智能应用弹性及资源弹性产品能力,推动对 AI 应用场景的端到端弹性伸缩优化。
  • 设计研发自主智能运维 Agent ,通过自动故障感知根因定位与自愈决策闭环,提升运维效率。

岗位要求

  1. 毕业起止时间要求

2026-11-01 - 2027-10-31

  1. 基础条件:
  • 计算机、软件工程等相关专业优先。
  • 热衷于数据结构和算法,在 ACM/ICPC 等竞赛中成绩优异者优先;有 K8s 或容器相关开源社区贡献( Kubernetes/KubeFlow/Volcano/OpenKruise 等)或高性能存储/网络开发经验者加分。
  1. 专业能力:
  • 系统工程与编程能力: 具备扎实的 Linux 系统底层基础(熟悉网络栈、文件系统、进程管理等),熟练掌握 Go 语言(核心)、Java 、Python 或 C++,具备复杂的分布式系统调试能力。
  • 容器与编排生态: 对 Kubernetes 架构有深入理解,熟悉容器 Runtime ( Docker/containerd/CRI )原理,有 K8s 自定义 Controller/Scheduler 开发经验者优先。
  • AI 系统领域专业知识:
    • 理解 AI 推理/训练的资源特征(如显存、带宽、通信模式)。
    • 熟悉容器化环境下 AI /Agent 任务的架构及部署链路,了解如何通过容器技术优化模型加载、Checkpoint 保存、Memory 管理等环节。
    • 对大规模分布式工程架构有一定理解,关注系统的高可用性、可观测性及研发效能的提升。
  1. 能力特质:
  • 极致的性能追求:乐于挑战“毫秒级”的延迟瓶颈,具备良好的性能分析工具(如 ebpf, perf, flamegraph 等)使用与系统调优能力。
  • 工程化思维:具备良好的系统抽象与架构设计能力,能够将复杂的 AI 场景痛点转化为高可用、高可靠的系统工程方案。
  • 跨域协同:具备良好的技术视野,能够与模型算法工程师高效沟通,理解算力对业务的支撑逻辑,从底层视角拆解并解决 AI 工程挑战。
  • 极客精神:对 AI 大模型技术充满热情,渴望在分布式系统与大规模算力平台的交汇处实现技术突破。
  1. 工作地点

北京/杭州

构建 AI Agent 下一代调度与计算引擎-阿里星

岗位职责

  1. 构建既能实现极致性能(百毫秒唤醒)又能做到极致成本效益(资源利用率提升 XX%)的 Agent 基础设施底座;
  2. 主导设计和实现融合了 Agent Sandbox 、容器与虚拟化的统一调度系统。

岗位要求

  1. 毕业起止时间要求:2026-11-01 - 2027-10-31
  2. 计算机科学或相关专业背景,具备深厚的操作系统、分布式系统理论基础;
  3. 精通 Go/C++/Rust 中至少一种,具备大型、复杂底层系统或分布式调度系统的设计与开发经验;
  4. 熟悉 Kubernetes 架构,特别是其调度器( kube-scheduler )和资源管理机制;有二次开发或重度使用经验者优先;
  5. 深入理解 Linux 内核机制(如 cgroups 、namespaces 、内存管理、内核调度)或虚拟化技术( KVM, QEMU );
  6. 对解决复杂系统中的性能瓶颈与稳定性问题充满热情,并具备体系化的方法论;
  7. 有强烈技术热情和好奇心,自驱力和学习力强;具备良好的分析与解决问题的能力、沟通以及团队合作能力;喜欢挑战性的技术研发工作,善于攻坚克难,有创新热情,积极乐观,坚韧抗压,结果导向,能够持续推动问题的解决和突破。

加分项 :

  1. 有分布式系统调度算法(如 Borg 、Omega 、Mesos )的设计或研究经验;
  2. 有 eBPF 、CRIU 、gVisor 、Kata Containers 等云原生前沿技术的实践经验;
  3. 有 Hypervisor ( KVM/Xen )开发或性能优化经验;
  4. 在 Linux Kernel 、Kubernetes 、Docker 等顶级开源社区有活跃贡献;
  5. 掌握 AI 基础知识,掌握基础提示词工程,会使用 Al 专业工具,集成 AI 到个人工作流;有 AI 相关开发工具应用研发经验者优先,持有阿里云 ACA/ACP/ACE 认证证书者优先。

工作地点:

北京/杭州

( ps. 阿里星岗位和常规岗位实习统一招聘,根据面试评级调整,大家不要担心因为从常规岗位的内推而无法参与 A star 评级)

投递方式

发送简历到邮箱,并等待内推邮件确认:

mailto: [email protected]

或者扫描以下内推二维码:

https://uploadfiles.nowcoder.com/compress/mw1000/images/20260406/702387425_1775483579918/95299E308A1FB7120110DBF6EB2BA29F

有疑问也欢迎私信交流~