惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Microsoft Azure Blog
Microsoft Azure Blog
L
LangChain Blog
A
About on SuperTechFans
博客园_首页
GbyAI
GbyAI
人人都是产品经理
人人都是产品经理
NISL@THU
NISL@THU
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
IT之家
IT之家
博客园 - 司徒正美
大猫的无限游戏
大猫的无限游戏
MyScale Blog
MyScale Blog
Last Week in AI
Last Week in AI
S
SegmentFault 最新的问题
V
V2EX
D
DataBreaches.Net
B
Blog RSS Feed
Apple Machine Learning Research
Apple Machine Learning Research
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
博客园 - 聂微东
Vercel News
Vercel News
博客园 - 叶小钗
F
Full Disclosure
Google DeepMind News
Google DeepMind News
宝玉的分享
宝玉的分享
博客园 - Franky
WordPress大学
WordPress大学
小众软件
小众软件
T
The Blog of Author Tim Ferriss
阮一峰的网络日志
阮一峰的网络日志
T
Tailwind CSS Blog
The Register - Security
The Register - Security
Y
Y Combinator Blog
Jina AI
Jina AI
月光博客
月光博客
The GitHub Blog
The GitHub Blog
有赞技术团队
有赞技术团队
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
量子位
云风的 BLOG
云风的 BLOG
Hugging Face - Blog
Hugging Face - Blog
爱范儿
爱范儿
Blog — PlanetScale
Blog — PlanetScale
C
Check Point Blog
MongoDB | Blog
MongoDB | Blog
博客园 - 三生石上(FineUI控件)
美团技术团队
Engineering at Meta
Engineering at Meta
雷峰网
雷峰网
Recent Announcements
Recent Announcements

博客园 - iTech

7万星的AI交易框架:让大模型模拟投行多空辩论,自动做交易决策 71000颗星的AI交易团队:让大模型模拟投行分工,自动做交易决策 13400颗星的开源项目:输入一句话,AI全自动帮你做短视频 102颗星的沙盒:当AI学会自己写代码、跑测试、做部署 AI 技术日报 - 2026-05-08 29k 星的 PageIndex:不用向量数据库,靠推理就能做 RAG 每天花两小时刷信息?这个开源项目帮你全自动搞定 读源码像读小说?试了 DeepWiki 和 Zread,我再也不想裸读 GitHub 了 Matt Pocock 开源的这套 .claude 技能,为什么让工程师集体上头? Cursor Team Kit:Cursor 官方团队在用的 17 个 AI 工作流 AI 技术日报 - 2026-05-07 AI 技术日报 - 2026-05-06 AI 技术日报 - 2026-05-05 Anthropic CEO 说 12 个月内程序员要失业,我扒完他的底牌,发现事情没那么简单 把工程师的肌肉记忆装进 Claude Code,这个 4300 Star 的项目我后悔没早用 AI 技术日报 - 2026-05-04 AI 技术日报 - 2026-05-03 AI 技术日报 - 2026-05-02 六大 Agent 框架横评:谁支持 Skills?谁能自动创建 Agent?MCP 呢? Wechatsync:一个 Chrome 插件,一键把文章同步到 31 个平台 LangChain 开源了 Open SWE:Stripe、Ramp、Coinbase 内部都在造的编程 Agent Cockpit:把 Claude Code 从终端里搬出来,装进浏览器 Cursor 把自家的 AI Agent 开放了:写几行 TypeScript 就能调 Cursor 干活 AI 技术日报 - 2026-05-01 AI 写代码每次结果都不一样?Archon 用 YAML 工作流把 AI 编程变成流水线 AI 写代码比你快了,但你还是得学编程——只不过学法得换 腾讯的龙虾特工队:4 个 AI Agent 同日更新,全家桶正式成型 Agno 不做更聪明的 Agent,它要把所有 Agent 框架包进同一个操作系统 Hermes Agent 终于有了像样的 Web 界面,而且还支持远程访问 Datawhale 出了一套 29 学科知识地图,把 AI 的底牌全掀了 Hermes Agent 在聊天框里就能用的 20 种高级功能 一份 AGENTS.md 能顶一次模型升级?Augment Code 用数据说了算 NVIDIA 开源了一个「AI 沙箱」,20K Star,让 Agent 跑代码不再裸奔 60ms 冷启动、5MB 内存:腾讯开源的这个沙箱让 Docker 安全隔离像笑话 AI 技术日报 - 2026-04-30 AI 技术日报 - 2026-04-29 AI 技术日报 - 2026-04-28 Goose:Linux 基金会亲儿子,能撼动 Claude Code 和 OpenCode 吗? AI 技术日报 - 2026-04-27 AI 技术日报 - 2026-04-26 Google 把价值20美元/月的东西免费了,102K人已经抢到了 OpenClaw 和 Claude Code 网络搜索配置指南 AI 技术日报 - 2026-04-25 Anthropic 为什么遥遥领先:从 Cat Wu 专访看AI霸主的底层逻辑 Mac 本地跑大模型完全指南:你的苹果电脑就是 AI 工作站 同样 70B 参数,为什么 MoE 只激活 13B 就能打平 Dense? DeepSeek-V4 技术报告里藏着一条线:华为昇腾 NPU 已完成推理验证 DeepSeek-V4 深夜炸场:1M 上下文、384K 输出、双模型,API 定价直接卷到底 MacBook Air 跑大模型实测:Ollama、llama.cpp、LM Studio 谁才是本地推理之王? AI 技术日报 - 2026-04-24 OpenCode:Claude Code 的最佳平替 2026 开源大模型五国杀:Qwen 3.6 vs Gemma 4 vs Llama 4 vs GLM-5.1 vs DeepSeek V4 MCP 与 Skills 的你死我活:Anthropic 的 Agent 生态野心与开发者的站队困境 给 AI Agent 配搜索,国内能用的搜索 API 实测对比 AI 技术日报 - 2026-04-23 CC Switch:49K Star 的 Claude Code 登录绕过神器,还能管 Codex 和 Gemini CLI NVIDIA 开出 32 万美元年薪招 AI Agent 工程师,JD 里藏着这些信号 fast-mirror-skill 技术拆解:一个小而完整的 Claude Skill 是怎么设计的 Cursor 值 600 亿美元?马斯克这次赌的不是技术,是入口 AI 技术日报 - 2026-04-22 别再问 AI 能不能赚钱了:3 个上班族亲测有效的副业方法(2026 最新版) 10 分钟从零搞定 Hermes Agent:飞书微信双通道丝滑上线 AI 技术日报 - 2026-04-21 Anthropic 实战总结:AI Agent 的 3 种工作流模式,选错代价很大 安装 openclaw,hermes 慢的想发疯,fast-mirror-skill 来救了 Claude Routines:你下班睡觉了,Agent 还在为你干活 微信飞书里敲一个斜杠就能干活:Hermes Quick Command 到底多省事 AI 正在疯狂吃电:算力尽头是电力,谁能解这道题? AI 技术日报 - 2026-04-20 3K 行代码造一个越用越聪明的 AI Agent:GenericAgent 登顶 GitHub Trending 高德途途封神机器人半马,背后的 ABot-Claw 到底是什么 人们希望 AI 能干啥?Anthropic 调查:第一名不是赚钱,是变强 AI 时代人们在担心什么?Anthropic 的 13 条焦虑排行榜 OpenAI 官方 Agent SDK 来了:22k Star,支持 100+ 模型,Python 10 行代码上手 AI 技术日报 - 2026-04-19 OpenAgents Workspace:让 Claude Code 和 Codex 在同一个群里干活 Claude 是要干掉整个软件行业吗? Claude 官方推荐多 Agents 设计模式 多 Agent 系统的 5 种协调模式:选错了模式,再强的 Agent 也白搭 AI 技术日报 - 2026-04-18 AI 技术日报 - 2026-04-17 Better-Harness:让AI Agent自己优化自己的革命性框架 OpenClaw Workspace 完全指南:我的AI编程工作流 DeepSeek内蒙草原高薪招聘:AI时代的数字牧民梦,还是营销噱头? 2 核 2G 的阿里云 ECS 能跑 OpenClaw 吗?能,但有点折腾 AI 技术日报 - 2026-04-16 OpenCLI:一个命令行搞定 16+ 内容平台的神器 从零到精通:OpenClaw CLI 命令完全指南 AI 技术日报 - 2026-04-15 AI Agent 如何自我进化?Hermes Agent Self-Evolution 深度解析 AI 技术日报 - 2026-04-14 为什么你的飞书 Bot 总是连不上?OpenClaw Gateway 架构深度解析 OpenClaw 连接飞书的原理:Gateway、Channel 与消息流转 国内安装 Hermes Agent 踩坑全记录:从 GitHub 超时到正常跑起来的每一步 35 万 Star 的 OpenClaw:5 分钟部署你的私人 AI 助手,直连飞书 AI 技术日报 - 2026-04-13 公司用 AI 筛简历,这个开源项目让候选人用 AI 反选公司 为什么 Google ADK 可能是你下一个 Agent 框架——7 个改变游戏规则的特性 Microsoft Agent Framework 深度解析:架构设计与实战落地 AI 技术日报 - 2026-04-11
阿里开源 Open Code Review:确定性工程 × LLM Agent 的混合架构,已发现数百万代码缺陷
iTech · 2026-06-17 · via 博客园 - iTech

阿里开源 Open Code Review:确定性工程 × LLM Agent 的混合架构,已发现数百万代码缺陷

AI Code Review 不新鲜,但真正能稳定落地到研发流程的产品很少。

阿里巴巴最近开源了 Open Code Review(OCR)——一款 AI 驱动的代码审查 CLI 工具。它的前身是阿里集团内部的官方 AI 代码审查助手,过去两年服务了数万名开发者,识别了数百万个代码缺陷。经过大规模内部验证后,正式以 Apache-2.0 协议开源给社区。

项目地址:https://github.com/alibaba/open-code-review

本文大纲

  • 通用 Agent 做 Code Review 的三大痛点
  • 核心设计:确定性工程 × Agent 混合架构
  • 四层规则优先级链
  • 快速上手:从安装到集成
  • 与 Coding Agent 的深度集成
  • 这套架构真正在说什么

通用 Agent 做 Code Review 的三大痛点

如果你用过 Claude Code + Skills 或其他通用 Agent 做代码审查,大概率遇到过这些问题:

覆盖率不全:变更集较大时,Agent 会"偷懒"——选择性地只审查部分文件,漏掉其他文件。你以为审查完了,实际上有些文件根本没被看过。

定位漂移:报告的问题和实际代码位置对不上。行号、文件引用经常偏移,开发者需要手动去找问题到底在哪。

质量不稳定:纯自然语言驱动的 Skills 难以调试,审查质量随 Prompt 的微小变化而剧烈波动。今天能发现的 Bug,明天可能就漏掉了。

阿里团队总结的根本原因:纯语言驱动的架构缺乏对审查过程的硬性约束。

核心设计:确定性工程 × Agent 混合架构

Open Code Review 的核心理念是把"绝对不能出错"的部分交给工程逻辑,把"需要动态判断"的部分交给 LLM。

确定性工程:硬性约束

对审查过程中必须正确的步骤,用工程逻辑而非语言模型来保证:

精确文件选择:由工程逻辑决定哪些文件需要审查、哪些应该过滤,确保不遗漏任何重要变更。支持 include/exclude 模式,二进制文件自动排除,测试文件可按需纳入。

智能文件分组:将相关文件组合成一个审查单元——比如 message_en.propertiesmessage_zh.properties 会被打成一个 Bundle。每个 Bundle 作为独立 Sub-Agent 运行,上下文隔离。这是一种分治策略,在超大变更集上依然稳定,且天然支持并发审查。

细粒度规则匹配:根据每个文件的特征匹配对应的审查规则,让模型的注意力始终聚焦。相比纯语言驱动的规则引导,基于模板引擎的规则匹配更稳定、更可预测。

外置定位和反思模块:独立的 Comment Positioning(评论定位)和 Comment Reflection(评论反思)模块,系统性地提升 AI 反馈的位置准确性和内容准确性。不是让模型自己"猜"问题在哪一行,而是由独立模块验证和修正。

Agent:动态决策

Agent 的优势集中在真正需要灵活性的地方:

场景调优的 Prompt:深度优化过的代码审查专用 Prompt 模板,提升效果的同时减少 Token 消耗。

场景调优的工具集:从大规模生产数据中的工具调用 Trace 分析中提炼——包括调用频率分布、每个工具的重复率、新工具对整体调用链的影响——最终产出一套专为代码审查设计的工具集,比通用 Agent 工具包更稳定、更可预测。

Agent 可以读取完整文件内容、搜索代码库、检查其他变更文件以获取上下文,生成深度审查意见——而不只是基于 diff 的表面反馈。

四层规则优先级链

OCR 使用四层优先级链来解析审查规则,每层采用 first-match-wins:

优先级 来源 路径 说明
1(最高) --rule 参数 用户指定路径 CLI 显式覆盖
2 项目配置 <repoDir>/.opencodereview/rule.json 项目级规则,可提交到 Git
3 全局配置 ~/.opencodereview/rule.json 用户级个人偏好
4(最低) 系统默认 内置 system_rules.json 覆盖常见语言和文件类型

内置规则已覆盖常见风险:

  • 空指针风险(NPE)
  • SQL 注入
  • XSS 漏洞
  • 线程安全问题
  • 参数校验缺失
  • Mapper SQL 配置错误

规则文件使用 JSON 格式,支持 ** 递归匹配和 {java,kt} 大括号扩展:

{
  "rules": [
    {
      "path": "force-api/**/*.java",
      "rule": "All new methods must validate required parameters for null values"
    },
    {
      "path": "**/*mapper*.xml",
      "rule": "Check SQL for injection risks, parameter errors, and missing closing tags"
    }
  ],
  "include": ["src/main/**/*.java"],
  "exclude": ["**/generated/**"]
}

快速上手

安装

# NPM(推荐)
npm install -g @alibaba-group/open-code-review

# macOS (Apple Silicon)
curl -Lo ocr https://github.com/alibaba/open-code-review/releases/latest/download/opencodereview-darwin-arm64
chmod +x ocr && sudo mv ocr /usr/local/bin/ocr

配置 LLM

# 交互式配置(推荐)
ocr config provider    # 选择内置或自定义 Provider
ocr config model       # 选择模型

# 或手动配置
ocr config set llm.url https://api.anthropic.com/v1/messages
ocr config set llm.auth_token your-api-key-here
ocr config set llm.model claude-opus-4-6
ocr config set llm.use_anthropic true

支持 Anthropic、OpenAI、DashScope、DeepSeek 等多种 Provider,也兼容 Claude Code 环境变量。

审查

cd your-project

# 工作区模式:审查所有暂存、未暂存和未跟踪的变更
ocr review

# 分支范围:比较两个引用
ocr review --from main --to feature-branch

# 单个提交
ocr review --commit abc123

# 预览将被审查的文件(不调用 LLM)
ocr review --preview

CI/CD 集成

ocr review \
  --from "origin/main" \
  --to "<commit_sha>" \
  --format json

项目已提供 GitHub Actions 和 GitLab CI 的集成示例。

与 Coding Agent 的深度集成

OCR 不只支持 CLI 使用,还能作为插件集成到主流 AI Coding Agent 中:

Skill 安装

npx skills add alibaba/open-code-review --skill open-code-review

Claude Code Plugin

/plugin marketplace add alibaba/open-code-review
/plugin install open-code-review@open-code-review

注册 /open-code-review:review 斜杠命令,运行 OCR 并自动过滤和修复问题。

Codex Plugin

codex plugin marketplace add alibaba/open-code-review

安装后可通过 @Open Code Review review my current changes 直接调用。

手动复制命令文件

mkdir -p .claude/commands
curl -o .claude/commands/open-code-review.md \
  https://raw.githubusercontent.com/alibaba/open-code-review/main/plugins/open-code-review/commands/review.md

这种方式零依赖,直接把命令文件放到项目中,团队成员通过 Git 共享。

这套架构真正在说什么

Open Code Review 的核心贡献不是"又一个 AI 代码审查工具",而是一个架构判断:AI 代码审查的工程管线比 Prompt 更重要。

通用 Agent 做 Code Review 失败的原因不是模型不够强,而是把一切都交给了语言模型——包括那些不应该由语言模型决定的事情。文件选择、位置定位、规则匹配,这些步骤的正确性应该是确定的,而不是概率性的。

确定性工程 × Agent 的混合架构,本质上是在回答一个更深层的问题:在 AI 系统中,哪些决策应该由模型做,哪些应该由工程逻辑做?

答案是:需要"绝对不能出错"的约束由工程逻辑保证,需要"动态理解和判断"的能力由模型提供。两者各做各擅长的事,组合起来才是一个可靠的系统。

这也是为什么 OCR 能在阿里内部服务数万开发者、发现数百万缺陷——不是因为 Prompt 写得多好,而是因为工程管线保证了每一次审查的覆盖率、定位准确性和规则匹配精度。

项目地址:Open Code Review


作者: itech001
来源: 公众号:AI人工智能时代
网站: https://www.theaiera.cn/
每日分享最前沿的AI新闻资讯和技术研究。

本文首发于 AI人工智能时代,转载请注明出处。