让 AI 审代码,难点不只是“看懂”,还要把每个改动都看完,并把问题准确标在对应行。阿里开源的 Open Code Review 是一款 CLI——可在终端运行、方便接入 Git 和自动化流水线的工具。它读取 Git diff(本次代码改动),再让可调用工具、分步分析的 LLM Agent 检查上下文,输出行级评论。
它更值得注意的是“先约束流程,再交给模型判断”:程序负责筛选文件、把相关文件分组,并按文件匹配工程规则;Agent 则读取完整文件、搜索代码库和查看其他改动。项目方称,这能减少漏看文件、评论位置漂移和提示词变化带来的质量波动。在一套覆盖 50 个开源仓库、200 个真实 Pull Request 和 10 种语言的基准中,作者称它使用同一底层模型时,Precision 与 F1 高于通用 Agent,耗费约九分之一的 token,但 Recall 较低——也就是宁可少报,也尽量减少误报。