惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Recent Announcements
Recent Announcements
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Last Week in AI
Last Week in AI
Scott Helme
Scott Helme
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
L
LINUX DO - 最新话题
S
Security @ Cisco Blogs
Webroot Blog
Webroot Blog
S
Security Affairs
H
Hacker News: Front Page
TaoSecurity Blog
TaoSecurity Blog
W
WeLiveSecurity
G
GRAHAM CLULEY
T
Tenable Blog
Schneier on Security
Schneier on Security
S
Securelist
Cyberwarzone
Cyberwarzone
P
Privacy International News Feed
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
S
Schneier on Security
Hacker News - Newest:
Hacker News - Newest: "LLM"
Recent Commits to openclaw:main
Recent Commits to openclaw:main
O
OpenAI News
N
News and Events Feed by Topic
AWS News Blog
AWS News Blog
C
Cisco Blogs
T
Threat Research - Cisco Blogs
S
Secure Thoughts
大猫的无限游戏
大猫的无限游戏
C
Check Point Blog
The GitHub Blog
The GitHub Blog
G
Google Developers Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
美团技术团队
Martin Fowler
Martin Fowler
Microsoft Security Blog
Microsoft Security Blog
L
LangChain Blog
Apple Machine Learning Research
Apple Machine Learning Research
爱范儿
爱范儿
D
DataBreaches.Net
博客园_首页
MyScale Blog
MyScale Blog
博客园 - 叶小钗
博客园 - 三生石上(FineUI控件)
P
Proofpoint News Feed
J
Java Code Geeks
SecWiki News
SecWiki News
P
Palo Alto Networks Blog
Know Your Adversary
Know Your Adversary
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
拿下OpenAI Offer后,她复盘了57场面试:Transformer要会手写,LeetCode还得刷
Tina · 2026-06-24 · via InfoQ - 促进软件开发领域知识与创新的传播

Alisa Liu 下周就要加入 OpenAI 了。

在这之前,她刚刚结束了一场漫长的求职过程:参与了 11 家公司的 57 场面试,还有另外的 46 次招聘沟通,以及 16 次 offer 之后的沟通。她把这段经历写成了一篇求职复盘,很快在 AI 圈传开。

Alisa 在华盛顿大学完成了为期六年的自然语言处理博士学位,求职方向主要是研究科学家和技术团队成员这类岗位。按很多人的想象,拥有这样的背景去面试顶级 AI 公司,最关键的考察应该是论文、研究方向、模型理解和前沿判断。但她的复盘让大家意识到:一旦进入正式面试流程,真正被反复检验的仍然是编程基本功。

会不会写代码,会不会实现模型,会不会在类似 LeetCode 的算法题里快速找到数据结构和算法解法,这些基础的东西依然绕不开。

在评论区,许多 AI 研究人员也提到了类似经历。

Meta 的研究科学家 Mimansa Jaiswal 说,她第一次完整的全流程面试就是 Anthropic,当时 9 轮面试里有 2 轮 Colab 编程没发挥好。她后来才意识到,编程面试必须提前练。

另一位来自 Meta 和纽约大学的 AI 研究人员 Ravid Shwartz Ziv 也回忆,很多年前他第一次参加公司面试时,面试官给了他一些编程任务,30 分钟后回来,他大脑一片空白,一行代码都没写出来,面试官只说了一句“谢谢,也许下次吧”,然后关门走人了。

顶级 AI 公司最常考的还是技术基本功

Alisa 在复盘中写道,她一共面试了 11 家公司,经历了 57 场正式面试。这个数字还没有包括另外 46 次招聘沟通、16 次拿到录用意向后的进一步交流,以及求职前后大量非正式的人脉沟通。

在这个过程中,她对顶级 AI 公司面试到底在考什么,有了一个比较具体的观察:“总的来说,技术能力和技术知识比研究经验更受重视,尽管研究经验很可能是获得面试机会的关键。”

她在复盘中把面试大致分成了几类:机器学习编程、通用编程、技术讨论、研究讨论、行为面试、数学面试和工作报告。

出现最频繁的是机器学习编程面试。这类面试要求现场动手实现。题目可能要求你实现一个给定的模型架构、一种解码策略、一个传统机器学习算法,有时也会是更有创造性的任务。熟练使用 PyTorch 是必备能力;少数情况下,她会被要求只能使用 NumPy,比如从零写反向传播,但面试官并不期待她记住 NumPy 的具体语法。

第二类是通用编程面试。 基本上就是 LeetCode,有时会加一点变化。

这里打好基础很重要,因为很多数据结构和算法概念也会出现在机器学习编程面试中。也就是说,即便面试的是 AI 岗位,动态规划、图、哈希表、树、堆、双指针、二分查找这些东西仍然可能影响最后结果。

第三类是技术讨论。 这类面试不需要写代码,但技术含量很高。有时候,整场面试会围绕一个主题展开,比如如何设计实验来回答某个研究问题,或者完成某个技术目标。面试官通常会不断追问你的设计选择,也会让你解读一些假设性的实验结果,并据此设计后续实验。还有一些面试更像一连串快速问答,比如:位置编码有哪些不同方式?什么是 5D 并行?PPO 和 GRPO 有什么区别?这类问题的目的,是让她证明自己确实熟悉这个领域。前一种面试考察的是思考方式,后一种则考察知识面的广度。

第四类是研究讨论。 这类对话是博士期间最常训练的。面试官通常会先让你介绍一个过去做过的项目,然后顺着这个项目继续追问。他们也可能会问到你简历上的其他论文。准备这类讨论时,很有必要退后一步想清楚:当初为什么选择这些问题,过程中形成了哪些洞察和判断,以及你认为哪些未来方向更有前景。

她还会根据不同岗位调整自己的研究介绍,因为面试官也很累,候选人如果能更快命中岗位相关关键词,对方就更容易判断你的背景是否匹配。

第五类是行为面试。 她说这类面试基本就是标准行为面试,只是偶尔会出现关于 AI 安全或社会影响的问题。

她的教训是,不能因为觉得自己“表现一直不错”就轻视这类面试。她第一次行为面试就失败了,因为面对一些非常简单的问题时,大脑一片空白,临场很难一边回忆博士期间的经历,一边把它组织成一个符合问题的故事。她建议提前列出博士期间一些印象深刻的经历,并把它们对应到常见行为面试问题上,这样面试时才能快速调用。

第六类是数学。 有些公司会安排数学面试,内容从有趣的逻辑谜题,到需要用纸笔完成的严肃数学推导都有。她建议复习概率、线性代数和微积分。

最后一类是工作报告,也就是 job talk。相比学术界的报告,工业界的 job talk 通常更短,也更聚焦在一篇论文或一个研究方向上。她自己的 job talk 主要围绕 tokenizer 展开,大部分时间讲一篇一作工作,然后简要覆盖几篇二作和正在进行中的工作,因为这些内容刚好能串成一个比较完整的方向。

Transformer 要练到肌肉记忆,写代码时还要关掉 AI

Alisa 在复盘中写道,准备面试几乎是最值得投入时间的事情。

对她来说,这个过程很像重新回到本科阶段:做笔记、画图、刷练习题,整天待在咖啡馆里,确保自己把机器学习的基础概念真正理解透。技术面试很难,而且它考察的能力并不会自动从研究经历里长出来,需要在研究之外专门投入时间训练。

她说,对她自己以及她聊过的大多数人来说,“找工作本身就是一份全职工作”。

她的准备过程,是从 Stanford 的 Language Modeling from Scratch 课程开始的。

她看完了这门课的全部 lecture,这能帮助她看到自己需要补齐的知识范围,也能把脑子里很多分散的概念重新组织成一张关于语言模型的完整图景。打完基础之后,她把剩下的时间用来逐个深挖概念:读相关博客和论文,跟 ChatGPT 和 Claude 进行大量的交流,同时练习从零实现各种功能。

她特别把 Stanford 这门课里的 Homework 1 拎了出来。她认为这个作业“至关重要”,因为 Transformer 的实现和调试在面试中出现得太频繁了,把它练成肌肉记忆,会带来非常大的回报,也完全不值得在这种地方丢分。

这份 Homework 1 是 Stanford CS336 的第一个基础作业,主题就是从零构建一个 Transformer 语言模型,不是调用现有模型在框架里改几个参数。

作业要求学生亲手实现链路中的每一层。提供作业的仓库 cs336_basics/*中明确写着:“这里没有现成代码,你可以完全从零开始,按自己的方式实现。”

首先要求实现 byte-level BPE tokenizer,需要理解基本的编码和子词切分机制,并写出可训练、编码和解码的 tokenizer。还要求学生分别在 TinyStories 和 OpenWebText 上训练这个 tokenizer,比较不同语料训练出来的压缩效果和词表差异。

接下来是从零实现 decoder-only Transformer 语言模型,包括 embedding、Transformer block、causal self-attention、RoPE、前馈网络和输出层,重点在于把张量维度和 attention mask 处理正确。

最后,还需要实现交叉熵损失、AdamW 优化器和完整训练循环,并支持模型与优化器状态的保存与加载,形成一个最小可用的语言模型训练流程:原始文本进来,经过 tokenizer 变成 token ID,再进入 Transformer 训练,最后生成样本文本,并用 perplexity 衡量效果。

更关键的是,这个作业对“从零实现”的要求非常严格。除了 torch.nn.Parameter、torch.nn 里的容器类,以及 torch.optim.Optimizer 基类之外,学生不能直接使用 torch.nn、torch.nn.functional 或 torch.optim 里的现成高级组件。换句话说,线性层、归一化、attention、loss、optimizer 这些核心部分,都不能简单调用官方封装糊弄过去,而要自己真正写出来。

并且这份作业虽然允许学生用 AI 工具回答高层概念问题,或者查询函数签名、库 API 这类文档信息,但不允许用 AI 工具实现任何作业代码,包括 Cursor Agents、Codex、Claude Code 这类编码代理,还要关闭 Cursor Tab、GitHub Copilot 的补全功能。因为之前的学生反馈说,关闭 AI 自动补全让他们更容易深入理解材料。

这也和 Alisa 的面试建议一致。她提醒在练习的时候“务必确保在练习编码的时候关闭 AI 辅助功能,以模拟真实的面试环节,否则会低估自己对 AI 的依赖程度!”

她还说,这种面试准备过程最像一种高强度临时备考:“每次面试都像是一门略有不同的数学或计算机科学课程。你从未上过课,却只有大约三天时间来准备期中考试。”

参考链接:

https://alisawuffles.github.io/blog/job-search/