惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

大猫的无限游戏
大猫的无限游戏
Webroot Blog
Webroot Blog
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
T
Threat Research - Cisco Blogs
V2EX - 技术
V2EX - 技术
L
LINUX DO - 热门话题
Google DeepMind News
Google DeepMind News
Recorded Future
Recorded Future
S
Schneier on Security
I
InfoQ
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
The GitHub Blog
The GitHub Blog
S
Security @ Cisco Blogs
O
OpenAI News
W
WeLiveSecurity
Vercel News
Vercel News
阮一峰的网络日志
阮一峰的网络日志
Simon Willison's Weblog
Simon Willison's Weblog
人人都是产品经理
人人都是产品经理
Cloudbric
Cloudbric
The Last Watchdog
The Last Watchdog
The Hacker News
The Hacker News
Google Online Security Blog
Google Online Security Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
GbyAI
GbyAI
NISL@THU
NISL@THU
T
Tailwind CSS Blog
V
Visual Studio Blog
PCI Perspectives
PCI Perspectives
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
Jina AI
Jina AI
D
DataBreaches.Net
B
Blog RSS Feed
N
News and Events Feed by Topic
N
News and Events Feed by Topic
H
Heimdal Security Blog
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
腾讯CDC
Latest news
Latest news
V
Vulnerabilities – Threatpost
Hacker News: Ask HN
Hacker News: Ask HN
WordPress大学
WordPress大学
V
V2EX
aimingoo的专栏
aimingoo的专栏
博客园 - 司徒正美
Apple Machine Learning Research
Apple Machine Learning Research
D
Darknet – Hacking Tools, Hacker News & Cyber Security
The Register - Security
The Register - Security
Help Net Security
Help Net Security

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
打破“人月神话”,Agent 重塑风控场景产运研职能
作者:王东旭,快手磁力引擎风控技术负责人QCon全球软件开发大会罗燕珊 · 2026-06-12 · via InfoQ - 促进软件开发领域知识与创新的传播

在 AIGC 技术出现阶跃式突破、软件工程范式从 1.0 快速迈向 3.0 的背景下,传统的产品、运营、研发协作模式正在经历前所未有的效能考验。本文整理自快手磁力引擎风控技术负责人王东旭 QCon 全球软件开发大会 2026 北京站的分享《打破“人月神话”,Agent 重塑风控场景产运研职能》。

王东旭在此次分享中系统梳理了过去半年里团队在大模型时代推动组织智能转型的最新实践。他从"AIGC 已将安全、效率、体验的不可能三角推向极限"这一现实困境出发,提出固态组织必须向"液态组织"转型:让产品经理用 Prompt to Product 模式直接交付原型、让运营从配置规则表达式升级为模型教练、让研发以 CLI 模式逃离职业阶梯的中空化困局。演讲后半段,他坦诚复盘了 Vibe Coding 的工程落地之坑与组织变革中的冲突教训。

以下是演讲实录(经 InfoQ 进行不改变原意的编辑整理)。

AI 时代危机:被“协调税”压垮的传统产运研模式

我所在的团队负责整个快手商业内容安全审核和站内/联盟广告流量反作弊,今天的演讲,会专注于内容安全这一部分,在这个每天处理上亿条短视频的场景里,我们长期面临一个“安全、效率、体验”的不可能三角。随着 AIGC 技术爆发,这个三角的张力被拉到了极致。

支撑这个三角形的,是一个非常经典的从左到右依次为运营、产品、研发的固态组织。运营负责感知和发起需求,交给产品经理分析并产出 PRD,PRD 再由技术研发转化为系统、数据或模型,最后交还给运营做线上规则配置。运营本质上就是感知业务,然后完成规则表达式的配置。在运营和产品之间、产品和技术之间,各有一条隐形的虚线,那是清晰分工之上的“部门墙”。墙的存在让职责明确,但也让职能变得单一且割裂。

随着 ChatGPT 横空出世,技术发展曲线出现了一个巨大的不连续断点。AIGC 能力带来内容量的井喷式爆发,系统压力指数级上涨,同时任何人都可以轻松通过 prompt 进行图生文、文生图乃至图生视频,攻击对抗变得空前强烈。

在这个技术跃迁面前,我们面临一个现实困境:就算继续增加团队规模,产出也很难呈现老板期望的四十五度角线性增长。《人月神话》中的经典悖论——“一位女性怀胎十个月生一个孩子,那么十个人一个月是不是就能把孩子生出来?”——在大模型爆发的背景下变得更为尖锐。一个更深层的问题是,在大模型时代,执行力本身已经商品化。写代码变成了一件相对简单的事,真正的困难在于跨部门之间的沟通摩擦和信息对齐。技术已经发展得很快,但人的组织方式还没有跟上。

这引出了 Karpathy 对软件工程的三个阶段的定义。他提出,我们正在经历从软件 1.0 到 3.0 的升级转变。1.0 是工业化分工阶段,核心资产是代码行数;2.0 是 Copilot 过渡阶段,团队关注的是模型权重;而 3.0 是 AI Native 原生阶段,核心资产变成了高密度 Context 上下文。当下效能陷阱的本质,就是技术发展的速度比组织和个人的迭代速度快了半拍:技术已经到达原生阶段,但组织依旧停留在过去的范式里。基于这一判断,我们团队发起了一场面向 AI 原生的组织转型。

职能重塑之路:风控产运研如何构建 AI 超级组织

我们团队有运营、产品、技术三大角色,技术侧又进一步细分为算法和研发,算法包括行为概率统计类算法和 CV 算法,研发则包含传统 Java 系统开发和数据研发,技术团队整体规模峰值近百人。在这次转型中,我们的核心出发点是:每个角色都要向价值链的上游去做升级和转型。

在传统的固态组织下,产品、运营、研发、算法之间像砖块一样边界清晰。产品只需要面向 PRD 交付产品设计原稿,研发接受 PRD 编写代码、交付系统和模型,算法则在自己的一亩三分地里不断迭代 BERT 和 ResNet。我们想要重塑的是一种“液态组织”,一个以数据为中心、职能边界变得非常模糊的协作网络。产品和运营的同学开始能够完成过去需要研发去承担的工作,研发也可以向算法侧延伸。原来那种成编制、成建制的师级单位,正在被类似于合成旅一样、麻雀虽小五脏俱全的小军团所取代。

从产品、研发和运营三个层面来看,我们都有了不同程度的实践。在产品层,我们通过 Agent 驱动做了产品原型设计的一些 Agent,让大模型直接出 UI 设计稿,还有需求撰写 Agent 帮助产品经理快速完成独立且确定性高的产品原型设计,甚至还会让 AI 去给产品经理写的 PRD 打分。在研发层,我们正在尝试所谓的 L3 研发模式,覆盖从需求理解到编码、测试、运维发布的完整流程。在运营层,我特别鼓励技术同学跳出“编码是否更快、交付是否更强”的单一视角,去思考如何让整个团队创造更大价值。而我们在运营这一层做的事情,已经让运营同学的角色发生了质的跃升。

大约半年前,很多产品经理同学还相对焦虑,因为技术同学天生离大模型更近。但最近的晋升评审给了我一个很强烈的感受,这或许可以算作一个暴论——低代码平台正在消亡。过去产品经理做原型设计时,经常会借助低代码平台,通过配置化、组件化拖拽来完成设计稿。但今天,每一个产品经理都可以使用 Vibe Coding。低代码平台的好处是固化、可以快速出原型或 Demo,但在这个时代,它实际上是限制了优秀产品经理的想象力。可拖拽的组件就那么几个,如果你想表达天马行空的想法,根本没有出入口,只能“削足适履”。从与行业人士的交流来看,做低代码平台的团队也都在尝试与 AI 结合进行转型。

我们团队对于产品经理的工作提出了一种新模式,叫 P2P,即 Prompt to Product,通过编写 prompt 直接完成产品原型设计。去年下半年开始,我们大量实践了 Figma、Lovable、Bolt.new 等 Vibe Coding 产品。产品经理掌握了这些技能之后,某种意义上已经可以替代部分相对低水平研发同学的工作。以我们团队的一个技术门户需求为例,过去产品经理需要等研发排期,一个双周迭代只能做二十个需求,第二十一个就会溢出。而现在,产品经理可以直接在 Lovable 上通过面向浏览器的口令方式把需求做出来,不再需要等待研发。

从我们的视角来看,产品同学掌握这些技能后,正反两个方向的效果都很明显。正向是产品经理可以帮助研发同学挡掉一些简单需求,变成研发的“搭子”。但从另一个方向看,尤其是对于我们团队相对年轻的研发同学,被冲击的面非常大。当产品经理都能搞定这些工作的时候,要那么多研发做什么?这既是好处,也蕴含着切实的危机。但无论如何,通过 P2P 这种模式,产品经理的产能确实得到了显著提升。

我们团队的运营过去的工作模式是接收外部风险信号,然后在线上规则引擎里做配置。在大模型时代,这种工作的可替代性非常强,部分一线审核员实际上已经被大模型替换掉了,这些运营人力的简单职能被大模型取代后,还顺势完成了 AI Native 的职能升级转型。在我们场景里,它经历了三个层次的变化。

第一层是 Prompt Engineer。可能现在还有部分技术同学以能写出一个很强的 CoT 风格的 prompt 为荣,但从去年开始,在我们团队这件事应该是运营同学去做的。我们团队的运营写出的 prompt 非常厉害,不是一个简单的一句话指令,而是带有结构化思维链的。因为场景是多模态的,他们甚至能做图文交替、模态融合的 ICoT。之所以会有这样的转变,是因为我们判断运营对线上业务要比技术同学了解得更深,让运营直接与大模型对话,把领域知识经验交给大模型,才是更为彻底的做法。

但仅有 Prompt Engineer 还不够。大模型在多多少少都会出现幻觉问题。于是我们场景的运营同学不但要会写 prompt,还要能把自己领域的知识,比如看健康行业或电商行业的经验,完整做到 RAG 知识库里,通过线上规则的结构化、向量化,大大降低模型的幻觉问题。这就是第二层,从 Prompt 运营到 RAG 运营。

更进一步,我们在 2025 年 Q2 完全叫停了技术同学去做这些事情。第一,不要再写 prompt;第二,RAG 运营也不是研发该干的活;第三,更激进、更极致一点,我甚至不让算法同学再做有监督微调 SFT。在早期这个事有护城河,但随着技术发展,算法再去做已经是一种低水平的重复。于是我们在 2025 年 Q3 左右,把整个模型的有监督微调做成了一个线上化平台,已经有一部分能力较高的运营同学可以完成模型 pipeline 的运维,充当模型的教练。

总结下来,运营的角色变化就是从传统的写规则表达式,到成为 Prompt Engineer,再到 RAG 运营,最后到模型教练。只要你把工具做得足够平民化、线上化、抽象得足够好,运营就能完成这些跃迁。通过这种方式,我们团队的运营同学完成了一个相对不错的面向 AI 原生的转型,我可以很确定地说,他们在市场上是非常值钱的。

大模型对研发同学的影响面可以用一条微笑曲线来描绘。曲线的横轴是职级,从 junior 到 Staff+,纵轴是影响程度。越是资深的同学且拥抱 AI,其能力会被无限放大,对应微笑曲线右侧的加持效应。但还有一部分同学,尤其是刚入场的校招生或小白,受到的冲击是负向的,是所谓的 Danger Zone。因为他们向上卷经验卷不过资深同学,向下和大模型比产出速度也比不过,于是就出现了“职业阶梯中空化”的尴尬局面。如果年轻人跟不上去,整个团队就会面临断层。

要逃离 Danger Zone,就必须用 Code Agent 把自己武装起来,让自己成为一个小军团。我们团队在 2025 年到 2026 年年初这段时间,经历了三个阶段的摸索。

第一阶段是类似 Cursor 的 IDE 模式,偏向 Copilot 辅助编码。第二阶段,我们在 2025 年十一月左右推动研发同学用 Lovable 这样面向浏览器对话框的方式做 Vibe Coding。但现在回忆起来,这个阶段可能多多少少走了一点弯路,因为这种面向浏览器对话的方式并不太适用于技术同学,反而更适合产品、运营同学。第三阶段,我们感觉走对路了,就是 CLI 模式。国外技术论坛 Latent Space 上有一个观点叫“CLI is the future”。我自己最近一年写代码很多,日均 Token 消耗一亿但不再用 IDE,效率很高。这是三个阶段的真实心路历程。

在具体需求承接上,我们按照颗粒度分为小、中、大三种,采取的实践也不尽相同。小的需求,尤其是一些产品经理就能搞定的,用 Chat 对话的方式完全没问题,不必强行要求做 Spec-Driven Development。中等的需求,例如我们团队数据开发同学大量用 SQL 交互交付,我们就定义了大量 Skills,通过这些 Skills 就能把事情做得相当不错,这种场景根本用不到 Spec。只有相对大型的需求,我们才绕不开 Spec Coding。

这里需要提一个观察。现在 AI 圈流行造词,去年大家讲 Prompt Engineer,现在讲 Context Engineer、Harness Engineer。概念层出不穷,但核心并没有太大变化。Harness 这种东西,在我看来并没有那么神秘,无非就是 Token 消耗够不够多。我在团队里会设定一个坎,每天一亿 Token,这是一个相对 OK 的状态,部分头部研发同学消耗量还会更多,Token 消耗得多,自然就会去考虑通过各种手段约束 Coding Agent 的输出,其实这就是一种 Harness。

我团队还有四、五十位算法同学。在研发同学纷纷转型算法工程的大背景下,算法同学还能有什么护城河?我们的实践可以归纳为两个方向:向下深耕模型能力和向前构建数据飞轮。

向下深耕的第一块是预训练。我们并未做大模型全模态基座的端到端预训练,而是在 Visual Pre-training 视觉表征层,基于 SigLIP 搭建了自研的视觉对比学习方案。第二块是 mid-training,我们依托海量图文风控数据,在多模态大模型基座上开展领域增量续训,而非简单注入数据;该多模态架构参考 LLaVA / QwenVL 的多模态对齐思路,重点让模型掌握风险识别能力。第三块是后训练,核心聚焦偏好对齐环节,包含两种核心策略。第一种是 DPO 方式,依托风控场景的人工复核结果,形成 “判定偏好对”,这类天然的偏好样本对,非常适合用于强化学习对齐。第二种是 GRPO 方式,我们团队在该方向的相关研究成果,已被 AAAI 2026 接收录用。今年,我团队还将继续在 CVPR、ECCV 等顶会发力,争取实现更多技术突破。这里我想表达的是,大模型时代,即便是聚焦业务落地的团队,也能深耕技术深度,在学术领域取得亮眼成绩。

讲到模型能力,就不得不提我们今年重点落地的数据飞轮体系。行业内极具参考价值的标杆便是 Scale AI,此前已被 Meta 收购。其创始人 Alexandr Wang 凭借成熟的数据闭环建设思路,搭建起完整高效的数据生产、筛选、迭代闭环,这也是当下大模型能力持续迭代的核心动力。

结合业务实际来看,2026 年我们在多模态大模型上的核心发力方向,除了优化模型架构、迭代训练策略之外,更核心的重心将全面转向搭建适配内容安全风控场景的专属数据飞轮,以高质量数据驱动模型能力长效进化,这套思路对于团队技术建设与长期业务提效,都具备极强的指导意义。

除此之外,去年全年的团队绩效考核,以及近期的团队薪酬调整,我均严格遵循既定原则推进。本次调整重点将各岗位 AI 能力转型、数字化提效成效纳入核心考核维度,具体标准请看图示。

坑点和教训:转型过程,那些苦涩的记忆

过去半年多的实践里,我们踩过三个重要的大坑。

第一个是 Vibe Coding 工程落地坑。简单说就是“Demo 惊艳全场,生产一塌糊涂”。做 Vibe Coding 的时候,基本是想到哪儿说到哪儿,他写到哪儿。随着项目时间推移,上下文会腐化,本质原因是模型的注意力窗口比较小,这里面就出现了确定性的业务结果要求与 LLM 的概率性输出之间的矛盾。

怎么解?我们现在的实践更多是采用 Spec-Driven Development 模式,从提议到设计到 Spec 规约,再到 Coding,最后到测试,环环扣死。我们最近整理了一份 SDD 技术选型,例如 YC CEO 推的 gstack 在全局上下文方面表现不错,Superpowers 已经 150 K 的 star,相对普及度很高;Open Spec 则适合做增量项目的隔离。

第二个坑是增量和存量项目的差异。增量项目本身就没有历史包袱,是 AI Native 的,很 work,但存量项目极易失效。坦白说这件事我们还没有做得特别彻底,但也在充分探索。我经常看 Anthropic 和 OpenAI 官网的博客,美国的程序员同样在探索存量项目如何演变。我有两个观点。第一,未来的 Git 仓库会有很大变化,它应该是面向 AI 的,而不是面向人的,结构上大概率会包含非常非常多的 Markdown。有人调侃扎克伯格收购 Manus 就是收购了几百万个 Markdown,但在 AI 时代 Markdown 很值钱。第二,构建软件仍然需要纪律,但这个纪律不在于代码,而在于以后 Markdown 的结构。我们的尝试可以概括为三点:一是“反向重构 Context”,因为存量代码没有这些东西,需要反向补上;二是补充大量的语义知识,因为 AI 缺上下文语义;三是建立严格的质量测试与质量门禁,生码能力太强,但没有人约束它。

第三个坑是团队管理坑。去年 AICon 结束后,我回到团队大量推组织升级,但我的问题是追求面面俱到,认为自己能做到的团队所有人都能做到,忽略了大家时间分配、能力水平和意愿度的差异。结果十二月到年初那段时间冲突和矛盾非常多。最近一个季度的反思,我总结了三个字:试、推、升。“试”是不要再追求面面俱到,现在还不到时候。如果你的老板要求你面面俱到,你不妨把这个结论反馈给他,因为有的团队过去半年已经踩过大坑。“推”是在有了局部试点成功之后,再做小范围推广,让一小部分人先富起来、先信起来。作为管理者,还可以把架构做一些局部调整,让汇报线层次不要那么深,因为我是二级主管。“升”则是全面重塑,我们现在正在从“推”到“升”的第三阶段迈进。希望这个三步演进能让更多人少踩点儿坑。

组织行动建议:下一步,该怎么走?

面向未来,我给出三点具体的组织行动建议。

第一点是推行 Token 经济学与 Skills 贡献度考核。以后我会看两个指标。一个是 Token ROI,分母是 Token 消耗量,我一定会看;但消耗多不代表产出多,分子还要看你通过每天消耗一亿、三亿 Token,对团队的产出和贡献到底是什么。另一个指标是 Skills 贡献度,个人能力强不代表组织能力强。我们团队有一个 Skills Hub,上面有排行榜,排行榜前面的同学不是被卷的,而是被激励的。只有把个人能力注入到团队的 Skills 体系中,组织效能才能最大化。

第二点是“逆康威定律”的应用。康威定律告诉我们,组织架构决定系统架构。前面讲到的运产研边界墙就是一个典型表现。当大家的职能边界被打开、组织变得更加液态的时候,系统的形态也会随之改变。这是我对于组织面的一个畅想。

第三点是我个人一直践行的一句话,叫:做“眼高手低”的技术人。“眼高”在于洞察,一定要对前沿技术知识保持想法,真的有热爱在里头。“手低”就是手还是要低下去。我看在座很多同学都很资深,我虽然年纪不算大,但也在行业里做了十多年,我一直告诉自己手不能离开一线,每天 Token 消耗过一个亿是常态。有段时间我跟团队同学讲,如果你想在 AI Coding 这个事上 diss 我,先让 Token 消耗超过我再说。

今天 QCon 大会的主题叫“大模型,正在重新定义软件”。而我们也在重新定义我们自己。唯一的护城河,是你和你的组织进化的速度。

作者介绍

王东旭,快手磁力引擎风控技术负责人。先后在百度、第四范式、阿里巴巴任职,专注于在商业化广告风控领域的安全风险对抗,著有《广告与营销风控:方法与实践》,主导了快手商业化广告的 KwaiBLM 大模型审核和 AhaEdit AI 生成式修复规模化落地,对 AI 时代组织的人机协同关系有深刻实践和思考,曾在 AICon 2025 北京站做 AI 时代的 10x 个体和组织主题分享。

会议推荐

6 月 26-27 日,AICon上海站即将开幕!60 + 顶尖专家携一线实战案例齐聚,聚焦构建可信赖、可规模化、可商业化的 Agentic 工程实践,一站式打通 AI 工程化卡点、从源头避坑!欢迎报名咨询👇