Claude Code Router 实战指南:一套本地网关管住所有编码 Agent 和模型
Claude Code Router 实战指南一套本地网关管住所有编码 Agent 和模型【免费下载链接】claude-code-routerOne local control plane for every AI agent: route across models, fuse new capabilities, orchestrate tools, and stay fully in control.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-routerClaude Code Router下称 CCR是一个本地模型网关跑在你自己机器上、替所有 Agent 统一转发模型请求的中转层。你不用再为每个 AI 编程工具单独配模型把 Claude Code、Codex 等编码 Agent 指向同一个本地地址就能自由切换上游模型路由、回退、日志一次配齐。每个 Agent 单独配模型有多乱结论先行接入 CCR 之后模型配置从每个工具一份变成全局一份换模型不再需要动 Agent 的配置文件。对比项只用单一 Agent 自带配置接入 CCR 之后换模型逐个改每个 Agent 的配置/环境变量在网关里改一次所有 Agent 生效模型挂了请求直接失败手动重试自动重试 按顺序回退fallback即主模型失败后自动切备用模型多 Key 管理Key 分散在各配置文件里统一放在凭据池中轮换额度用尽自动切下一条谁在烧钱基本看不到请求日志记录每条请求的供应商、模型、耗时、token 和成本估算给模型补能力只能换整包模型用Fusion组合模型给已有模型加装看图、联网搜索、MCP 工具CCR 默认在http://127.0.0.1:3456提供网关服务管理界面在http://127.0.0.1:3458。它支持 OpenAI、Anthropic、Gemini、OpenRouter、DeepSeek、Moonshot 等协议供应商预设都内置了接入时不用手填地址。装好 CCR让 Agent 走网关主线只有一条检查环境 → 安装 → 加供应商 → 应用 Agent 配置 → 看日志确认。环境检查CLI 版本要求 Node.js 22 及以上node --version版本不够就先升级 Node。如果你偏好图形界面也可以直接下载桌面应用支持 macOS、Windows、Linux配置流程和 CLI 完全一致。安装并启动npm install -g musistudio/claude-code-router ccr uiccr ui会拉起后台服务并打开浏览器管理界面。没有桌面的服务器上加--no-open然后手动访问打印出来的地址。最小配置在管理界面里按顺序做三件事供应商页点添加供应商选一个内置预设如 DeepSeek、OpenRouter填入 API Key。CCR 会自动探测协议和可用模型点检测连通性确认真实链路通了再保存。API 密钥页创建一个 CCR 客户端密钥——这是 Agent 访问网关用的凭据和管理界面的 Token 是两回事。Agent 配置页选 Claude Code或 Codex 等指定一个默认模型应用配置。验证跑通从 CCR 启动你的 Agent而不是直接打开发一条消息然后打开Logs页。你能看到这条请求命中的供应商、模型、状态码、token 数和耗时——看到日志说明请求确实经过了 CCR。记住一个排查口诀日志里没有这条请求问题几乎都在服务没起、Agent 不是从 CCR 启动的、配置没应用这三项里。路由进阶条件匹配还是脚本规则CCR 的路由分三层按需往下走第一层默认模型。不写任何规则时请求直接走 Agent 配置里指定的模型。日常够用就先停在这里。第二层条件规则。在路由页添加规则规则按列表顺序匹配第一条命中即生效。每条规则 一个条件匹配请求头或请求体字段 一个动作改写成目标模型/供应商。适合某类请求固定走某个便宜模型的场景比如给特定项目标签的请求统一降到低成本模型。第三层Node.js 脚本规则。单个条件表达不了多字段判断、灰度分流这类逻辑时把规则类型切成脚本指向一个本地.js/.mjs文件。脚本拿到完整的只读input请求体、请求头、估算 token 数、最后一条用户消息等返回要路由到的模型即可// 长上下文请求切到长上下文模型否则不命中 if (input.tokenCount 30000) return null; return { model: 供应商/长上下文模型 };编辑器里可以直接用 JSON 测试请求试跑脚本不产生真实上游消耗。脚本异常或超时会自动放行fail-open到下一条规则不会把你的服务卡死。内置路由别忽略。Claude Code 场景下有一个很实用的机制给模型填上Description一句话说明适合什么任务CCR 会把模型清单注入到 Claude Code 的 Agent/Task 工具说明里派生的 Subagent 会根据描述自动挑选合适的模型主请求和子任务各走各的模型全程不用你手动切。三个拿来就能用的工作流场景一日常对话用便宜模型难任务才上强模型。供应商里加一个低成本模型和一个强模型路由页加一条条件规则请求体特征命中复杂任务的走强模型其余全部落到默认的低成本模型。效果简单问答的成本降一个量级复杂任务质量不掉。场景二Subagent 自动分工。给三个模型分别填 Description适合快速搜索和摘要、适合大规模重构和跨文件推理、适合长文档整理然后在 Claude Code 里用 Agent/Task 派生子任务。效果Claude Code 根据模型描述自己决定派生请求用哪个模型主 Agent 保持强模型子任务吃掉的是便宜模型的额度。场景三给代码模型装联网搜索。用 Fusion 把你的主力文本模型 内置联网搜索组合成一个新模型命名建议写清来源如代码模型 Web Search。效果原本不能联网的代码模型直接在 CCR 里变成一个能查最新文档、最新报错的模型组合结果像普通模型一样出现在路由和配置中基础模型的推理手感不变只补齐能力短板。排障与调优先看日志再谈配置所有排障从Logs页开始日志里每条请求都带request model、resolved provider、resolved model、状态码、耗时和成本。401 / 403是凭据问题不是路由问题。查 Key 是否正确且已启用、Base URL 和协议是否匹配改完用供应商页的连通性检查验证。model not found模型名出现在三处——供应商模型列表、路由规则、Agent 配置逐一对比把不一致的改掉。命中了错误模型对比日志里的request model和resolved model再回路由页检查规则顺序和匹配条件——规则是顺序匹配的顺序错了就会命中错。超时看耗时集中在哪一段上游慢、Fusion 工具执行慢、timeout 设太短三种原因对应不同调法。成本突然变高时不要猜按模型或供应商筛选日志看 token 组成和请求体大小增量来自哪类请求一目了然。高频调用场景再补两件事凭据池轮换多 Key、给路由规则配置回退模型保证单点失效不影响整体可用性。更多细节见 智能路由文档、Fusion 组合模型 和 常见问题。收尾CCR 的核心价值一句话把选模型、换模型、模型挂了、钱花哪了这四件事从散落在每个 Agent 配置里的日常琐事收敛成一个本地网关里的可视化操作。现在就可以做的一件事装好 CCR 后先只加一个供应商、跑通第一条日志再谈路由和 Fusion——闭环没验证之前所有进阶配置都是空中楼阁。【免费下载链接】claude-code-routerOne local control plane for every AI agent: route across models, fuse new capabilities, orchestrate tools, and stay fully in control.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-router创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考