本文要点
- OCR 是专用代码审查 CLI,不是聊天机器人:读 Git diff → 工具调用检索上下文 → 输出行级评审意见;同源模型下 Token 约为 Claude Code 通用审查的 ~1/9,Precision/F1 更高(Recall 略低,少噪音)。
- 内置 12+ Provider:
anthropic(Claude)、openai(GPT)、通义dashscope、DeepSeek、Kimi、智谱z-ai等;协议仅两种:Anthropic Messages 与 OpenAI Chat Completions。 - Gemini 不在内置表,但 Google 提供 OpenAI 兼容 API,填自定义 Provider 即可;Vertex AI 企业网关同理。
- 两条执行轨:① OCR 自管 LLM(
ocr review);② Delegation Mode(ocr delegate)——OCR 只做文件筛选与规则,审查由 Claude Code / Cursor 等 Agent 用自己的模型完成。 - 模型能力不是分水岭,审查流水线(确定性工程 + Agent)与计费轨(OCR API vs 订阅 Delegation)才是分水岭。
先行结论:Open Code Review 支持 Claude 和 GPT,Gemini 走自定义轨
审查质量的上限由模型决定,但信噪比与成本由 OCR 的确定性流水线决定——同一 Claude Opus,OCR 比 Claude Code 裸跑
/code-review更省 Token、更少误报。
截至 2026 年 8 月,alibaba/open-code-review 在 官方配置文档 列出 13 个内置 Provider。与本文主题直接相关的三条路径:
- Claude(推荐默认) —
ocr config set provider anthropic,协议原生anthropic;模型如claude-opus-4-6、claude-sonnet-4-6;自动读取ANTHROPIC_API_KEY或 Claude Code 的ANTHROPIC_*环境变量。 - GPT —
provider openai,走https://api.openai.com/v1;适合已买 ChatGPT Team / API 额度的团队,或想用gpt-5.x/o-series推理模型的场景。 - Gemini — 无内置 preset;通过
custom_providers指向 Google 的 OpenAI 兼容端点(https://generativelanguage.googleapis.com/v1beta/openai/),模型填gemini-2.5-pro等;企业可走 Vertex 网关 URL。
若你已是 Open Code Review Claude 生态用户(装了 Claude Code 插件),还可开 Delegation Mode:OCR 不碰外部 API,审查逻辑交给 Claude Code 会话内的模型——订阅额度与 OCR 审查共用一条账。这与「OCR 自管 API Key」是两条完全不同的成本结构。
1. 为什么「用 Claude Code 审一下」不够,还要 Open Code Review?
Claude Code 内置 /code-review Skill 能工作,但阿里内部两年规模化验证后,把 OCR 单独开源,核心痛点有三类:
- 覆盖不全 — 大 diff 时通用 Agent 容易「挑重点文件看」,漏审并改文件;OCR 用确定性文件选择 + 智能 bundling(如
message_en.properties与message_zh.properties绑成一组)保证全覆盖。 - 定位漂移 — 通用 Agent 的评论行号经常对不上;OCR 有独立的定位与反思模块,专门校正行级锚点。
- 质量波动 + Token 浪费 — 纯自然语言 Skill 难调试;OCR 官方 benchmark(50 个开源仓、200 个真实 PR、10 种语言)显示:同模型下 F1 / Precision 显著高于 Claude Code 通用审查,Token 约 1/9,耗时更短;Recall 略低是刻意少报,降低误报 triage 成本。
换句话说:Open Code Review Claude 不是「再套一层 Claude」,而是把 Claude 放进一条为审查优化的流水线。模型换成 GPT 或 Gemini,流水线不变——这才是多模型支持的意义。
2. Open Code Review 是什么?模型接入分几类?
2.1 产品定位
OCR 是 npm install -g @alibaba-group/open-code-review 安装的全局 CLI(命令 ocr)。典型流程:
ocr config provider # 交互选 Provider + 模型 + 测连通
ocr review # 审工作区 staged/unstaged 变更
ocr review --from main --to feature/x # 分支对比
ocr scan --path internal/agent # 全文件扫描(无 diff 也可)
Agent 可用工具包括 file_read、code_search、file_read_diff、code_comment 等——能跨文件引用,而非只看 patch 表面。
2.2 三类模型接入方式
| 接入类型 | 入口 | 典型模型 | 配置成本 | 适合谁 |
|---|---|---|---|---|
| 内置 Provider | ocr config provider |
Claude、GPT、DeepSeek、通义… | 低(填 API Key) | 多数团队默认路径 |
| 自定义 Provider | custom_providers.* |
Gemini、自建 vLLM、企业网关 | 中(URL + protocol) | 已有模型网关 / 合规内网 |
| Delegation Mode | ocr delegate |
Claude Code / Cursor 当前模型 | 零 OCR Key | 已付订阅、想省 API 账单 |
2.3 内置 Provider 完整清单(2026-08)
以下均预置 Base URL,只需 API Key(或对应环境变量):
| 名称 | 协议 | 代表模型 / 用途 | 环境变量 |
|---|---|---|---|
anthropic | anthropic | Claude Opus / Sonnet | ANTHROPIC_API_KEY |
openai | openai | GPT-5.x / o-series | OPENAI_API_KEY |
dashscope | openai | 通义 Qwen 系列 | DASHSCOPE_API_KEY |
deepseek | openai | DeepSeek V3 等 | DEEPSEEK_API_KEY |
kimi | openai | Moonshot Kimi | MOONSHOT_API_KEY |
z-ai | openai | 智谱 GLM | Z_AI_API_KEY |
volcengine | openai | 火山方舟 | ARK_API_KEY |
baidu-qianfan | openai | 文心千帆 | QIANFAN_API_KEY |
另有 dashscope-tokenplan、tencent-tokenhub、hy-tokenplan、mimo、minimax 等国内 Token 计划型端点 | |||
配置文件位于 ~/.opencodereview/config.json;单次覆盖模型可用 ocr review --model claude-sonnet-4-6,无需改文件。
3. Claude、GPT、Gemini:三条配置路径详解
3.1 Claude(Open Code Review 最顺路径)
Claude 使用原生 Anthropic 协议,不是 OpenAI 兼容层——工具调用与 Messages API 行为最稳定,也是阿里内部生产环境验证最多的组合。
# 交互式(推荐)
ocr config provider
# 选 anthropic → 粘贴 ANTHROPIC_API_KEY → 选 claude-opus-4-6
# CI 非交互
ocr config set provider anthropic
ocr config set model claude-sonnet-4-6
ocr config set providers.anthropic.api_key "$ANTHROPIC_API_KEY"
ocr llm test
与 Claude Code 环境复用:若本机已 export ANTHROPIC_AUTH_TOKEN / ANTHROPIC_BASE_URL(Claude Code 同款),OCR 会自动拾取,零重复配置。装 Claude Code 插件 后可在 IDE 内用 slash command 触发同一套审查规则。
选型建议:PR 合并前门禁 → Sonnet(成本可控);安全/并发/资金类核心模块 → Opus;可关 thinking 省 Token:ocr config set providers.anthropic.extra_body '{"thinking":{"type":"disabled"}}'。
3.2 GPT(OpenAI 官方轨)
ocr config set provider openai
ocr config set model gpt-5.2
ocr config set providers.openai.api_key "$OPENAI_API_KEY"
ocr review --from origin/main --to HEAD
GPT 适合已统一在 OpenAI Platform 买 API、或 GitHub Copilot 生态里习惯 OpenAI 模型族的团队。OCR 对 OpenAI 协议做 URL 规范化,Azure OpenAI 也可走 custom_providers 填部署端点。
与 Claude 比:在 OCR 流水线内,差异主要在模型推理风格(GPT 偏规范检查、Claude 偏边界条件),而非 OCR 功能缺失——两者工具集相同。
3.3 Gemini(自定义 Provider,非内置)
Google 未出现在内置表,但 Gemini API 提供 OpenAI 兼容层,按自定义 Provider 接入:
ocr config set provider gemini-google
ocr config set custom_providers.gemini-google.url \
https://generativelanguage.googleapis.com/v1beta/openai/
ocr config set custom_providers.gemini-google.protocol openai
ocr config set custom_providers.gemini-google.model gemini-2.5-pro
ocr config set custom_providers.gemini-google.api_key "$GEMINI_API_KEY"
ocr config set custom_providers.gemini-google.models \
"gemini-2.5-pro,gemini-2.5-flash,gemini-2.0-flash"
ocr llm test
长上下文审大型 monorepo 时,Gemini 的百万级 context 有理论优势——但 OCR 本身会做文件 bundling 与并发分片,多数 PR 用不到满上下文。更务实的理由通常是:团队已买 Google AI Studio / Vertex 合约,想账单归拢到 GCP。
Vertex AI 企业部署:把 url 换成区域端点(如 https://us-central1-aiplatform.googleapis.com/... 的 OpenAI 适配路径),protocol 仍为 openai。更多 Gemini 能力背景见站内 Gemini 3.5 Pro 解析。
4. Claude vs GPT vs Gemini:五维对比(在 OCR 流水线内)
| 模型族 | 入口 / 协议 | 执行能力(OCR 内) | 上下文 / 成本 | 权限 / 合规 | 适合人群 |
|---|---|---|---|---|---|
| Claude | 内置 anthropic;可 Delegation 给 Claude Code |
工具调用最稳;插件 / Skill 一键集成 | Opus 贵但漏报少;Token 已比裸 Agent 省 ~9× | Anthropic 企业合规;可 Bedrock 自定义 URL | 追求审查质量默认选;已有 Claude Code 订阅 |
| GPT | 内置 openai |
与 Claude 同流水线;o-series 推理慢但深 | API 单价随型号波动;Team 额度不直接进 OCR | OpenAI 数据政策;Azure 私有部署 | OpenAI 单一供应商策略团队 |
| Gemini | 自定义 openai 协议端点 |
功能完整;需自测 ocr llm test |
Flash 便宜适合 CI 大批量;Pro 审核心路径 | GCP / Vertex IAM;国内直连视网络而定 | 已买 Google 合约;超长单文件 ocr scan |
横向对比编程 Agent 选型(非审查专用),可参考 GPT-5.6 与 Claude、Gemini 替代决策指南——那是「写代码」场景;本文是「审代码」场景,成本结构完全不同。
5. Delegation Mode:Open Code Review Claude 的「零 API Key」路径
若你不想为审查单独买 API,或公司禁止 OCR 持有生产 Key,用 Delegation Mode:
ocr delegate preview
ocr delegate rule src/handler.go src/handler_test.go
# OCR 输出规则与文件清单 → 粘贴给 Claude Code / Cursor Agent 执行
此模式下:
- OCR 负责确定性步骤:选文件、匹配规则(NPE、线程安全、SQL 注入等内置规则集)、生成审查任务包。
- LLM 推理由 Claude Code、Codex、Cursor 等已安装的 Agent 完成——用你已有的订阅或 Agent 额度。
- 官方提供 Claude Code 插件、Codex Skill、Cursor Skill,slash command 即可触发。
这是「Open Code Review Claude」搜索意图的最短路径:审查规则用 OCR,模型账单走 Claude Code Pro/Max。代价是失去 OCR 自管模型下的并发 CI 无人值守能力(除非 Agent 也在 CI Runner 上跑)。
6. 场景选择矩阵
| 场景 | 推荐模型 / 模式 | 原因 | 不推荐 |
|---|---|---|---|
| 个人开发者,已有 Claude Pro | Delegation + Claude Code 插件 | 零 OCR API 成本;规则仍比裸 /code-review 稳 |
再买一个 Anthropic API Key 重复计费 |
| 团队 PR 门禁(GitHub Actions) | OCR + Claude Sonnet API | 可脚本化、可并发、Token 可控 | Delegation(CI 无交互 Agent) |
| 开源项目,贡献者全球分布 | OCR + GPT-5 mini / Flash | 单价低、英文评论质量够 | 默认 Opus(成本过高) |
| 金融 / 安全敏感模块 | Claude Opus + ocr scan |
高 Precision;全文件审计 | 仅 diff 表面扫一眼 |
| 已签 GCP 企业约 | 自定义 Gemini + Vertex | 账单归 GCP;IAM 统一 | 强行另开 Anthropic 合同 |
| 国内内网,无外网 API | dashscope / deepseek 内置 Provider | 预置国内端点 | 直连 api.anthropic.com |
7. 推荐组合(Stack)
【Stack A — 独立开发者 · Claude 订阅党】
审查:OCR Claude Code 插件 + Delegation Mode
写码:Claude Code CLI(Sonnet 默认)
触发:本地 pre-push → ocr delegate preview
升级:PR 变大时改 ocr review --model claude-opus-4-6(API 按次)
【Stack B — 10 人工程团队 · API 统一账】
审查:GitHub Action 跑 ocr review(Sonnet)
写码:Cursor + Claude Code 并行
模型:ANTHROPIC_API_KEY 组织级;禁止个人 Key 进 CI
规则:.ocr/rules 自定义路径过滤
【Stack C — 多云模型 · 成本优化】
日常 PR:GPT-5 mini(openai provider)
周五安全扫:Gemini 2.5 Pro(custom provider)
核心发布分支:Claude Opus
切换:ocr review --model <name> 单次覆盖
【Stack D — 云 Mac CI Runner】
执行:kvmboot 云 Mac M4 常驻 Runner
审查:ocr review --from main --to $PR_BRANCH
环境:与 xcodebuild / 真机构建同机,审完即测
搭配:见站内 Claude Code 云 Mac 双 Agent 隔离文
Claude Code 订阅成本与 Delegation 是否划算,见 Claude Code 2026 价格解析;Skills 增强审查见 Claude Code Skills 排行榜(/code-review 与 OCR 可叠加,OCR 专精、Skill 通用)。
8. 常见误区
- 误区 1:OCR 只支持 Claude。内置同时有 OpenAI 与十余家国内/开源友好端点;Claude 是默认推荐,不是唯一。
- 误区 2:Gemini 不能用在 OCR。能——走
custom_providers+ OpenAI 协议;只是没有一键 preset,需多两步 URL 配置。 - 误区 3:换更强模型就能消灭误报。OCR 的 Precision 来自流水线;裸换 Opus 仍可能不如 OCR+Sonnet。
- 误区 4:Delegation 和 ocr review 效果完全一样。规则筛选相同,但 Delegation 依赖 Agent 会话质量,CI 无人值守应用 API 模式。
- 误区 5:ChatGPT Plus 订阅直接给 OCR 用。Plus 是聊天产品;OCR 要 API Key(OpenAI Platform)或 Delegation 给 Codex/Agent。
- 误区 6:审查语言跟模型走。评论语言由
ocr config set language 中文控制,与 Provider 无关。
9. 落地步骤(7 步)
- 安装 OCR:
npm install -g @alibaba-group/open-code-review,确认ocr --version与 Git ≥ 2.41。 - 选定计费轨:有 Claude Code 订阅 → 先试 Delegation;要 CI 门禁 → 准备 API Key。
- 配置 Provider:
ocr config provider选 anthropic / openai / 自定义 Gemini;ocr llm test必须通过。 - 本地冒烟:在真实仓库
ocr review,检查行级评论是否对齐 diff。 - 装 Agent 插件(可选):Claude Code / Cursor 安装 OCR 插件,统一团队 slash command。
- 接 CI:参考 官方 CI/CD 文档 在 PR 触发;用
--model区分日常与安全扫。 - 月度复盘:对比 API 账单 vs 误报 triage 工时;调模型档位而非盲目升 Opus。
若审查与构建在同一流水线,建议把 OCR 与 xcodebuild 放在同一 云 Mac 执行节点,避免审完还要等远程 Runner 排队。
10. FAQ
Open Code Review 支持 Claude 吗?
支持。anthropic 是内置 Provider,原生 Messages API;可配 Opus / Sonnet,也可通过 Claude Code 插件 + Delegation 复用订阅。
支持 GPT / OpenAI 吗?
支持内置 openai Provider,填 OPENAI_API_KEY 即可;Azure OpenAI 用自定义 URL。
支持 Gemini 吗?
无内置 preset,通过 custom_providers 指向 Google OpenAI 兼容端点即可;Vertex 企业同理。
和 Claude Code 的 /code-review 有什么区别?
同模型下 OCR 更省 Token、行级定位更准、误报更少;Claude Code Skill 更灵活但质量波动大。两者可叠加:OCR 做 CI 门禁,Skill 做本地快速扫。
可以不配 API Key 吗?
可以,用 ocr delegate 把推理交给 Claude Code / Cursor 等 Agent;OCR 仍负责文件与规则。
一次审查能临时换模型吗?
可以:ocr review --model claude-opus-4-6 单次覆盖,不改 config.json。
11. 总结
Open Code Review 支持哪些 AI?——Claude 与 GPT 开箱即用,国内还有通义、DeepSeek、Kimi 等;Gemini 走自定义 OpenAI 兼容轨;Delegation Mode 则把模型选择权交给 Claude Code / Cursor,实现「Open Code Review Claude」零重复 Key。
选型别陷入「哪个模型最强」——在 OCR 里,流水线比模型名重要。先定计费轨(API vs 订阅 Delegation),再定场景档位(Sonnet 日常 / Opus 门禁 / Flash 省钱),最后才微调 Provider。这样 Claude、GPT、Gemini 才是可替换的引擎,而不是三次重新造轮子。
CI 里跑 OCR + 构建,云 Mac 一台搞定
Open Code Review 在 PR 里审完代码,下一步往往是 xcodebuild、签名或跑集成测试——若审查 Runner 与构建 Runner 分离,排队和上下文切换会把节省的 Token 又吃回去。kvmboot 云端 Mac mini M4 可当统一执行节点:ocr review 与 iOS/macOS 构建同机完成,Apple Silicon 统一内存 扛并发审查 worker,macOS 原生环境 免 WSL 折腾;7×24 在线 适合 GitHub Actions self-hosted 或 launchd 定时扫仓。
先用日租跑通「OCR 审查 → 构建 → 测试」流水线,满意再升月租。 kvmboot 云端 Mac 是 Open Code Review + Apple 工具链的性价比执行平面—— 立即了解套餐方案 ,让 Claude / GPT / Gemini 的审查结果当场验证,而不是等下一台机器。