惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog
Microsoft Security Blog
Microsoft Security Blog
Jina AI
Jina AI
博客园 - 叶小钗
J
Java Code Geeks
博客园 - 聂微东
博客园 - 司徒正美
大猫的无限游戏
大猫的无限游戏
阮一峰的网络日志
阮一峰的网络日志
V
V2EX
美团技术团队
WordPress大学
WordPress大学
M
MIT News - Artificial intelligence
雷峰网
雷峰网
酷 壳 – CoolShell
酷 壳 – CoolShell
GbyAI
GbyAI
罗磊的独立博客
T
The Blog of Author Tim Ferriss
aimingoo的专栏
aimingoo的专栏
T
Tailwind CSS Blog
The Cloudflare Blog
Stack Overflow Blog
Stack Overflow Blog
N
Netflix TechBlog - Medium
小众软件
小众软件

V2EX

我用 AI 写代码,但终端管理反而成了累赘——于是我做了 codux [调研] 各位在公司都用什么 ide 和 agent 写代码? 老运维 share 一个运维平台 看到有公司考核 token 指标,很好奇大家上个月的 AI 账单是多少 GLM-Coding 调用持续报错: z.ai 的 Lite 套餐几乎无法使用,官方 Pro/Max 是否稳定? 现在还有什么渠道可以稳定安全地使用 Claude 吗? 上海漕河泾内推,本组有 2 个 hc,一个后端,一个前端,预算都是 20k 左右,不打卡,氛围好 如果 V2EX 上有一组不永久保存聊天记录(比如只保存 7 天或者 24 小时)的聊天室,那么会开启哪些有用或者有趣的可能? gemini cli 貌似挂了,一直返回 403 第一次在自媒体上赚到钱 收集了最近在使用的低价 GPT, Gemini,邮箱等 AI 会员的小店合集 讨论个大实话:现在企业还在说 AI 编程提效 20%, 30%的,真的太落后,没用懂 AI。因为包括很多前沿公司,已经狂奔到提效 200%-500%的情况 [招聘][远程][币安] 前端/后端/QA/iOS/Android 至少 3 年以上经验 目前有大量 HC 欢迎投递 Chatgpt Pro 用量用不完的可以开这些设置 面试的时候好像遇到钓鱼了,给各位避个坑 cursor 年续费 22 号到期, 自动续费是否还是老的计次套餐呢 被两件破事毁掉的一下午,琐碎的内耗消磨人的精力 使用 Planet 存储 Codex 的会话或者重要信息 如果业务部门领导不要你开发功能,而是要求你教会它用 claude code 开发功能,你会怎么做? 分享一个 MacOS 接绿联 CM818 USB 转 DP 转接器使用感受 我的 HR 朋友 10 年老 Java ,非全大专,大家帮忙看看简历 开源了一个 AI 口语练习工具,音素级发音评分,完全免费可自部署 V2EX 上有哪些你觉得很有趣、印象深刻的妹纸? 字节为啥不出个国内版 Vercel? 有在大马的朋友吗? 问个运营商问题 你们在有领导的公司大群发过的最大胆的消息是什么 公司裁员,目前没有工作。想试试摆摊,做一个移动鲜啤打酒车 我的硬盘 Memblaze Pblaze 5 Linux 下不识别,给 Linux 内核提交了补丁, AI 说有望被合并 只有我一个人觉得 codex 不好用?
[NVIDIA 内推 | 核心团队急招] 加入 Megatron Core,定义大模...
zoe1016aaa · 2025-12-03 · via V2EX

[ NVIDIA 内推 | 核心团队急招]

加入 Megatron Core ,定义大模型训练的未来!🚀 🔥岗位非常紧急,流程快!这是一个站在 AI 浪潮最前沿、极具技术挑战性的核心岗位。 我们正在寻找顶尖的 LLM 训练框架工程师 (LLM Train Framework Engineer) 加入 NVIDIA Megatron Core 团队。

[关于我们:]

Megatron Core 是 NVIDIA 构建的开源、可扩展、云原生的旗舰框架,专为研究人员和开发者设计,用于支持超大规模语言模型( LLM )和多模态( MM )基础模型的预训练与后训练。我们的 GenAI 框架提供端到端的模型训练解决方案,涵盖预训练、对齐、定制化、评估、部署以及性能优化工具链。

[你将负责什么 (Core Responsibilities):]

在这个岗位上,你将工作在 AI 应用、库、框架和整个软件栈的交汇点,直接参与构建下一代 AI 基础设施: 核心框架构建: 构建和开发开源的 Megatron Core 框架。 技术攻坚与创新: 引领模型架构、分布式训练策略和模型并行方法的技术演进。通过混合精度公式和先进的 NVIDIA GPU 结构,提升基础模型训练和优化的速度。 全生命周期解决: 解决大规模 AI 训练和推理中的复杂障碍,覆盖从编排、数据预处理,到模型训练、微调和部署的整个生命周期。 性能极致优化: 对深度学习框架和底层软件组件进行性能调优,榨干 GPU 的每一滴性能。 工具链开发: 研究、原型设计并开发健壮、可扩展的 AI 工具和流水线。

[我们需要你具备 (Must-Have Qualifications):]

硬性背景: 计算机科学、AI 、应用数学或相关领域的硕士/博士学位,并拥有 5 年以上 工业界实战经验。 核心技术栈: 精通 Python 编程。拥有丰富的 AI 训练框架经验(如 PyTorch, JAX ),熟悉推理和部署环境(如 TRTLLM, vLLM, SGLang )。 分布式专家: 对分布式指令、去中心化计算有深入理解。 工程能力: 具备出色的软件开发、调试、性能分析和测试能力。 加分项(强烈推荐):掌握 CUDA 或集合通信 (collective programming) 技能。

⚠️ 特别强调 (Critical Requirement): 该岗位涉及与全球团队协作及外国面试官面试,必须具备流利的英语读写及口语沟通能力。

[如何申请:]

这是一个加入 NVIDIA 核心引擎团队的绝佳机会。如果你对构建超大规模分布式系统充满热情,且技术硬核,请立刻行动。 📮 请直接发送 [英文简历] 至: [email protected] (邮件标题请注明:Megatron Core 申请 - 姓名)