新闻详情

新闻详情

首页 / 资讯中心 / 详情

Claude Code Router 接入 OpenRouter,管住模型成本与故障

发布时间:2026/10/8 1:36:47来源:尧图网络
Claude Code Router 接入 OpenRouter,管住模型成本与故障
Claude Code Router 接入 OpenRouter管住模型成本与故障【免费下载链接】claude-code-routerOne local control plane for every AI agent: route across models, fuse new capabilities, orchestrate tools, and stay fully in control.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-routerClaude Code Router下称 CCR是一个本地模型网关与路由控制面它给 Claude Code、Codex 等客户端提供统一的本机端点按你的规则把请求调度到 OpenRouter、DeepSeek 等上游供应商的具体模型上并负责重试、降级与请求观测。本文覆盖从安装、接入 OpenRouter、配路由规则到降级、凭据池与日常排障运维的完整闭环全部操作在本地终端与管理界面内完成。CCR 把三件事收进一个本地服务客户端只认http://127.0.0.1:3456这一个地址供应商、模型、路由规则、降级策略全部在管理界面里维护请求结果进日志可查。满足以下任意一条就值得花 20 分钟接入你有两个以上模型供应商或同一供应商的多条 Key 需要轮换你希望简单任务走便宜模型、关键任务走强模型而不是每次手动切换你需要知道每个请求最终打到哪个供应商、哪个模型、消耗了多少 token。用 ccr ui 启动网关并跑通第一条 OpenRouter 请求检查 Node.js 环境并安装 CLInpm CLI 要求 Node.js 22 或更高版本先确认版本node -v输出v22.x及以上即可继续低于 22 先升级 Node。全局安装 CLI 包并启动后台服务npm install -g musistudio/claude-code-router ccr ui服务拉起后自动打开浏览器管理界面无桌面环境用ccr ui --no-open常驻托管用ccr serve --no-open浏览器访问http://127.0.0.1:3458出现管理页面即成功。注意区分两个端口3458是管理界面端口3456才是模型网关端口客户端要配的是后者。添加 OpenRouter 供应商并检测连通性在供应商页面点击添加预设列表中选择 OpenRouter填写以sk-or-v1-开头的 API 密钥勾选要暴露的模型并保存目录里没有的模型 ID 可手动添加。预设供应商无需手填 API 地址协议与默认模型自动带出。点检测连通性并对个别模型发一次真实请求验证地址、密钥、协议和模型名都能用。检测请求会计费只勾选需要确认的模型不要一次全量检查结果中每个模型显示“可用”即成功。创建客户端 Key 并用 curl 验证网关在API 密钥页面创建一个 CCR 客户端 Key把客户端的 base URL 指向http://127.0.0.1:3456。客户端 Key 与发给上游的供应商 Key 是两套东西别混淆。验证网关是否在运行curl http://127.0.0.1:3456/health返回200说明网关可用尚未配置任何供应商时返回502属预期行为。带 CCR Key 发一个最小模型请求curl http://127.0.0.1:3456/v1/chat/completions \ -H Authorization: Bearer CCR客户端Key \ -d {model:OpenRouter/claude-3.5-sonnet,messages:[{role:user,content:ping}]}拿到正常补全响应即成功再到日志页面确认request model、resolved provider、resolved model、状态码与耗时都如实记录。安装细节见 安装与启动指南。为路由规则按场景改写模型用脚本做动态分流理解内置路由的默认行为CCR 的路由分两层。内置路由负责识别 Claude Code 与 Codex 的请求客户端没有选择可识别模型时主请求落到 Agent 配置里的默认模型Codex 访问非 GPT 模型时apply_patch工具会自动桥接为 function tool让三方模型也能改文件。这一层无需配置装完即生效。在路由页添加自定义规则自定义规则在路由页面维护按列表顺序匹配第一条命中的启用规则生效。一条规则由三部分组成条件来源选request.header或request.body配合、starts with、contains deep等操作符改写最常用的一行是把request.body.model设置为供应商/模型选择器也可以改 temperature 等任意 body 字段失败时这条规则自己的降级策略覆盖页面顶部的全局默认设置。常用规则写法对照目标条件改写批量任务走便宜模型request.header.x-client-name batch-job设置request.body.model OpenRouter/低价模型按原始模型前缀分流request.body.model starts with claude-设置request.body.model OpenRouter/旗舰模型带图请求走视觉模型request.body.messages contains deep image设置request.body.model 视觉供应商/模型用 Node.js 脚本规则做灰度分流普通条件不够用时把规则类型切换为Node.js 脚本脚本在独立 Worker 沙箱里读取完整请求可走api.fetch查询外部策略、api.fs读本地文件返回模型、改写与回退策略脚本异常时 fail-open继续检查下一条规则。脚本文件默认超时 2000 毫秒保存前可在编辑器里用测试请求 JSON 试跑。if (!input.body.model.startsWith(OpenRouter/claude-)) { return null; } return { model: OpenRouter/claude-haiku };规则编辑器显示脚本验证通过即成功。完整的input/api字段与返回值约定见 路由配置文档。给模型写 Description 让子代理自动选模在模型页面为每个模型填写 Description适合什么任务、速度与成本如何保存后 CCR 会把说明注入 Claude Code 的 Agent/Task/Workflow 工具描述派生子代理时客户端自行选模并携带模型标签CCR 据此把派生请求路由到对应模型。效果是主对话走强推理模型后台搜索、摘要类子任务自动落到便宜快模型无需人工干预。配置模型降级链、凭据池与本地限额生产环境要防三类故障上游偶发抖动、主模型限流、单把 Key 打满。对应四个配置项场景配置项生效条件偶发超时、限流、网络抖动失败处理选retry设重试次数上游返回408、409、429或5xx时重试当前模型主模型宕机或持续不可用失败处理选model-chain按序添加备用模型任意4xx/5xx触发按列表顺序切备用模型多把 Key 轮换避免单 Key 触发风控供应商高级设置展开凭据池设优先级与权重数字越小的优先级越先被选中同优先级按权重排序单 Key 本地限流凭据条目的限制 JSON如{rpm: 60, tpm: 100000}该 Key 窗口用量达到上限后自动跳过转用同供应商其他 Key降级等待默认从 1 秒开始指数退避单次最长 30 秒上游给了正的Retry-After头时优先遵守。全局默认失败处理覆盖所有未单独配置降级的请求规则级失败时配置覆盖全局设置。发生降级后响应头会带x-ccr-fallback-attempts等标记日志详情里也能看到关联的重试尝试列表方便复盘。按排障表定位故障用日志与账号面板做周度运维现象优先排查处理动作/health返回 502是否尚未配置供应商与模型属预期行为补全供应商与模型后重启网关上游 401 / 403供应商 Key 与 API 地址是否匹配核对密钥前缀与 Base URL用检测连通性复验客户端被拒绝是否误把供应商 Key 当成 CCR 客户端 Key到API 密钥页面重新创建客户端 Key路由规则不生效规则是否启用、顺序是否被前置规则抢走调整规则优先级确认改写目标是已配置的供应商/模型Agent 没走网关Agent 是否从 CCR 启动、配置作用范围是否覆盖用配置卡片上的按钮启动 Agent 重试某把 Key 频繁被跳过凭据池限额是否过紧或上游已限流该 Key放宽rpm/tpm或在供应商后台查额度运维节奏很固定每周花 10 分钟翻一次日志页找出实际高频命中的模型组合把稳定走旗舰模型但任务并不需要的请求加条件规则改写到性价比更高的模型看一眼账号面板里 OpenRouter 等供应商的余额与用量趋势用检测连通性抽查一次备用模型避免降级时才发现备胎不可用。请求日志只保留本地当天数据需要长期留存就定期导出。上线验收清单✅ 网关http://127.0.0.1:3456/health返回200服务页状态为运行中日志页能查到resolved provider/resolved model与预期路由一致关键工作流配了model-chain降级链且备用模型通过连通性检测客户端 Key 已分发供应商 Key 未直接暴露给客户端脚本类规则如有已用测试请求验证超时时间已设置更细的字段说明见 供应商配置文档。【免费下载链接】claude-code-routerOne local control plane for every AI agent: route across models, fuse new capabilities, orchestrate tools, and stay fully in control.项目地址: https://gitcode.com/GitHub_Trending/cl/claude-code-router创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

【外设】之大彩串口显示屏 2026/10/7 22:40:56

【外设】之大彩串口显示屏

大彩串口屏初步使用 1 .官网下载 STM32 屏幕 GUI 设计资料 http://www.gz-dc.com/category/typeid/4112 找到 STM32 Keil 工程,移植相关代码因项目而异进行移植,由于项目简单,本人只对用到的指令接口进行修改。 比如:注意事项&…

阅读更多 →
无法下载Windows系统iso文件 2026/10/7 8:13:40

无法下载Windows系统iso文件

当我遇到这个问题的时候,我打开了一个网站: 登录 然后我打算下载的时候: 突然那个官方的连接就可以下载了:

阅读更多 →
【清华代码熊】DeepSeek V4.1 Flash 后训练详解 2026/10/7 22:17:20

【清华代码熊】DeepSeek V4.1 Flash 后训练详解

📌 上期解析了 DeepSeek V4.1 Flash 模型架构改进,本期解析 DeepSeek V4.1 Flash 预训练/后训练技术: 🌟 预训练:45T 文本 多模态混合语料、直接训练 sparse attention(取消 DeepSeek V4 的 dense 冷启动&…

阅读更多 →
Shuffle-R1: Efficient RL framework for Multimodal Large Language Models via Data-centric Dynamic ... 2026/10/8 0:44:54

Shuffle-R1: Efficient RL framework for Multimodal Large Language Models via Data-centric Dynamic ...

文章主要内容和创新点 主要内容 本文聚焦于多模态大语言模型(MLLM)强化学习(RL)训练中的效率问题,提出了一个名为Shuffle-R1的框架。研究发现,当前RL训练存在两个关键缺陷: 优势值坍缩(Advantage Collapsing):批次中大多数优势值集中在零附近,导致有效梯度信号被淹…

阅读更多 →
PRvL: Quantifying the Capabilities and Risks of Large Language Models for PII Redaction 2026/10/7 12:13:57

PRvL: Quantifying the Capabilities and Risks of Large Language Models for PII Redaction

一、文章主要内容总结 本文聚焦于利用大型语言模型(LLMs)实现个人身份信息(PII)脱敏的研究,旨在解决传统脱敏方法(如基于规则的系统、领域特定命名实体识别(NER)模型)泛化能力差、跨格式/跨语境适应性弱的问题。 研究通过全面评估多种LLM架构(包括密集型LLM(D-LLM…

阅读更多 →
LLaVA-RE: Binary Image-Text Relevancy Evaluation with Multimodal Large Language Model 2026/10/7 23:16:39

LLaVA-RE: Binary Image-Text Relevancy Evaluation with Multimodal Large Language Model

文章主要内容和创新点 主要内容 本文聚焦于二进制图像-文本相关性评估任务(判断图像与文本“相关”或“不相关”),针对该任务中文本格式多样、相关性定义随场景变化等挑战,提出了基于多模态大语言模型(MLLM)的解决方案LLaVA-RE。 模型设计:LLaVA-RE基于LLaVA 1.5架构,…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉