
字节笔记本
2026年10月9日 · 约 7 分钟读完
通用 agent 漏看大 diff 时,把评审交给这条流水线
把 Claude Code 一类通用 agent 丢进大 diff,常见三种翻车:文件漏看、行号漂走、prompt 稍微改一点质量就抖。阿里把内部用了两年的评审助手开源成 Open Code Review,主张先用工程约束把不该错的步骤钉死,再让 agent 做动态检索和判断。仓库 alibaba/open-code-review,语言 Go,许可证 Apache-2.0。本轮 GitHub API 快照 44827 星,2026-05-18 建仓,10-08 还有推送。npm 包名 @alibaba-group/open-code-review,命令是 ocr。

它怎么拆一次评审
README 写得很硬:必须做对的步骤不交给语言模型。文件选择和过滤由流水线决定,相关文件会捆成一个 review unit,例如成对的多语言 properties。每个捆包交给隔离上下文的子 agent,大变更可以并发,也不靠模型“记得去看所有文件”。分而治之同时解决两件事:上下文不被整仓 diff 撑爆,漏看文件不再取决于模型心情。规则按文件特征做模板匹配,而不是把一长串自然语言规则塞进 prompt。评论定位和评论反思是独立模块,用来压行号漂移和内容跑偏。通用 Skill 评审最常见的尴尬是“说得对,但指错行”,这两块就是冲着这个去的。
agent 只做它擅长的部分:按场景调过的提示词、从生产工具调用轨迹里蒸馏出的工具集、读完整文件、搜仓库、看相邻变更,再吐出行级结构化评论。工具集不是通用 agent 那一套能改文件、能跑测试的大工具箱,而是从大规模生产数据里看过调用频率、单工具重复率和新工具对整条调用链的影响之后收出来的。除了 diff 评审,ocr scan 还能扫整文件或目录,适合没有像样 diff 的陌生代码。
官方站点是 open-codereview.ai。插件或 skill 能接到 Claude Code、Codex、Cursor、Kimi Code、OpenCode,以及 skill 兼容的其它宿主。QCA Forward 文档还写了用宿主模型跑 Delegation、并带一份可发布模板。执行分两种:默认由 OCR 自己配置的模型跑;Delegation Mode 把评审交给你正在用的编码 agent,不必再给 OCR 配一把 API key。这个分工很关键:文件圈选和规则解析仍由 OCR 的确定性部分完成,模型只负责读和写评论,所以换宿主时行为不会整段漂走。CI 文档列了 GitHub Actions、GitLab CI、GitFlic 和 Gerrit。还有浏览器里的 Session Viewer,可以把评论标成已修或忽略,一边改一边把噪声藏起来。观测走 OpenTelemetry。
官方基准怎么说

对比对象是通用 agent(文中点名 Claude Code),同一套底层模型。仓库声称 Precision 和 F1 更高,token 大约只有九分之一,速度也更快;Recall 更低,作者写成有意为之,换更少误报。表里同时报 F1、Precision、Recall、单次评审墙钟时间和平均 token,后两项直接对应 CI 等待和接口账单。基准叫 AACR-Bench:50 个流行开源仓、200 个真实 PR、10 种语言,80 多名资深工程师交叉标注,1505 条 ground-truth。数据集在 Hugging Face 的 Alibaba-Aone/aacr-bench。内部口径是两年服务数万开发者、标出数百万缺陷。这些都是项目自己的数字,不是第三方复现。README 没有在正文里展开逐项百分比,接入前应自己打开基准图或复跑数据集,不要把“更高”当成已经复核过的绝对值。
本机怎么跑
Git 要 2.41 及以上,diff 和搜索都走 Git。
npm install -g @alibaba-group/open-code-review
ocr config provider
ocr config model
cd your-project
ocr review
ocr review --from main --to feature-branch
ocr review --commit abc123
ocr scan --path internal/agent
ocr review --format json --output result.json
ocr delegate previewworkspace 模式会看 staged、unstaged 和未跟踪变更。范围评审和全量扫描都可以 --resume 接着跑,先 ocr session list 再带上 session id。JSON 输出方便给宿主 agent 接着处理。Delegation 可先 ocr delegate preview 看文件选择和规则,再 ocr delegate rule 针对具体路径。文档还列了安装脚本、GitHub Release 二进制和源码安装。Windows、macOS、Linux 都标了 supported。README 上有 OpenSSF Best Practices Gold 徽章。配置走交互界面选 provider、填密钥、选模型并测连通;也支持环境变量和自定义端点。MCP Server 文档写了给评审 agent 外挂工具的入口。
谁该用,谁先别上
适合已经在用编码 agent、却受不了“漏文件和行号乱飞”的团队,也适合想把评审推进 CI、又希望误报少一点的仓库。如果你们已经在 PR 里养了一只爱说话的通用 agent,这条流水线更像把嘴管住、把清单交给程序。内置规则集提到空指针、线程安全、XSS、SQL 注入,OpenAI 和 Anthropic 兼容端点都能配。规则文档支持按路径过滤和自定义。它不是通用编程代理,也不会替你合并 PR,更不会在没配模型或没走 Delegation 时凭空评完。Recall 更低意味着漏报会比“把所有可疑之处喊一遍”的 agent 多,这是写在文档里的取舍。本轮数字来自仓库 README 和 GitHub API,官方站点页本次 TLS 不稳,未二次核官网文案。GitHub 周榜和日榜都能看到这个仓,热度还在,但星数快照只代表本轮查询。



