新闻详情

新闻详情

首页 / 资讯中心 / 详情

codex-lb API密钥详解:Token、成本、时间窗、模型与账号绑定的5维限流

发布时间:2026/9/28 19:18:36来源:尧图网络
codex-lb API密钥详解:Token、成本、时间窗、模型与账号绑定的5维限流
codex-lb API密钥详解Token、成本、时间窗、模型与账号绑定的5维限流【免费下载链接】codex-lbCodex/ChatGPT multiple account load balancer proxy with usage tracking, dashboard, and OpenCode-compatible endpoints项目地址: https://gitcode.com/gh_mirrors/co/codex-lbcodex-lb是一个面向 Codex/ChatGPT 多账号的负载均衡代理其API密钥API Key不仅承担客户端认证更是精细限流的核心抓手你可以按Token 数量、美元成本、时间窗口、模型范围、绑定账号这 5 个维度组合出配额策略实现按预算管流量。本文带你从新手视角完整看懂这套 5 维限流机制 一、API密钥是什么如何启用与创建codex-lb 的API Key 认证默认关闭。开启后客户端必须携带密钥访问受保护代理路由/v1/*、/backend-api/codex/*、/backend-api/transcribeAuthorization: Bearer sk-clb-...开启路径控制面板Settings → API Key Auth。详细文档见 api-keys.md。创建密钥非常简单Dashboard → API Keys → Create。需要注意两点 完整密钥只在创建时展示一次务必妥善保存密钥支持可选的过期时间expires_at到期后自动拒绝请求。二、维度一Token 限流三种口径在 schemas.py 中可以看到限流规则支持 5 种limit_type其中 Token 类占 3 种类型含义适用场景total_tokens输入 输出总 Token最通用的总量控制input_tokens仅输入 Token限制长上下文塞入output_tokens仅输出 Token防止超长生成刷量实现上请求进入时代理会先预留额度reserve再按上游实际用量结算settle。相关逻辑位于 service.py 的_reserve_budget_for_limit_type中保证并发下不会超发额度。三、维度二成本限流cost_usdcost_usd规则按美元设上限。系统内部以微美元microdollar1 美元 100 万单位记账按请求的模型价格 × Token 数预估扣减若模型未知则按保守的兜底单价估算见 service.py 的_unknown_model_reserve_cost_budget_microdollars。 成本限流 未知模型兜底单价意味着即使遇到新模型也没办法绕过预算白嫖——这是新手容易忽略的安全细节。四、维度三时间窗限流5种窗口limit_window支持 5 种窗口在 models.py 的LimitWindow枚举中定义daily每日重置weekly每周重置monthly每月重置5h/7d对齐上游 Codex 的 5 小时 / 7 天额度节奏窗口重置采用惰性重置 推进策略到期不主动清零而是下次请求时自动把reset_at向前推进到第一个大于当前的重置点实现见 limit_windows.py 的advance_limit_reset——省掉了定时任务重启也不丢状态。⚠️ 当current_value max_value时请求会被直接拒绝并返回限流错误每个窗口各自独立计数互不干扰。五、维度四模型维度限流与模型管控模型管控有两层1密钥级模型策略allowed_models密钥只允许调用列出的模型enforced_model强制把请求改写到指定模型客户端写什么都会被覆盖apply_to_codex_model是否将上述策略应用到 Codex 模型。2限流规则的模型过滤LimitRuleCreate中的model_filter字段让每条配额规则只针对特定模型生效例如gpt-5 每周限 1000 万 Token其他模型不限判断逻辑在 service.py 的_limit_applies_for_request中请求模型不匹配的规则会被跳过实现分模型差异化配额。六、维度五账号绑定限流只消耗指定账号额度这是最实用的维度——把密钥绑定到指定账号池assigned_account_ids后该密钥只从被分配的账号中消耗配额互不抢占。典型用法团队 A 的生产密钥 → 绑定 2 个 Plus 账号团队 B 的测试密钥 → 绑定 1 个 Team 账号某个账号额度耗尽时只影响绑定它的密钥故障域被隔离。七、配额组合实战一个新手友好的配置清单综合 5 个维度一个稳妥的生产密钥通常这样配维度配置示例作用Tokentotal_tokens/weekly 5,000,000控总量成本cost_usd/weekly 20防超预算时间窗5hweekly双规则对齐上游节奏模型allowed_models [gpt-5.x-codex]只放行指定模型账号绑定 2 个活跃账号隔离故障域配置完成后可在密钥卡片上直接查看usage_summary请求数、总 Token、缓存命中 Token、累计成本与limits中每条规则的current_value/remaining_value/reset_at数据模型定义见 schemas.py 的ApiKeyResponse。八、常见问题FAQQ1限流被触发会怎样请求会收到明确的限流错误提示含触发的是哪条规则不会静默排队便于定位是 Token、成本还是窗口规则触顶。Q2窗口到期后额度怎么恢复惰性重置下一次请求自动推进重置点并清零计数无需重启服务。Q3能限制客户端的请求强度吗可以。密钥还支持enforced_reasoning_effort强制推理强度和allowed_reasoning_efforts允许列表越界请求返回403 reasoning_effort_not_allowed详见 api-keys.md 的 Reasoning effort policies 一节。Q4成本规则按什么价格算按请求实际使用的模型 × Token 数估算扣减未知模型走保守兜底单价确保预算不被绕过。总结codex-lb 的API 密钥限流把谁在用账号绑定、用什么模型管控、用多少Token/成本、多久重置时间窗五个问题收敛到一张密钥卡片里。作为多账号负载均衡代理这套5 维限流机制让团队配额管理像配置防火墙规则一样直观——上手只需在API Keys → Create中勾选几下即可开始精细化控制每一次 Codex 调用的成本 【免费下载链接】codex-lbCodex/ChatGPT multiple account load balancer proxy with usage tracking, dashboard, and OpenCode-compatible endpoints项目地址: https://gitcode.com/gh_mirrors/co/codex-lb创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

你的目标是嵌入式开发 2026/9/28 21:10:08

你的目标是嵌入式开发

你好,王**,很高兴认识你。真的是一眨眼么,也不一定,毕业两年了对吧。为啥要学C语言呢?在原公司待着做一辈子的机械设计师不也是挺好的么?可靠的发展路线和依旧低微的工资是吧。对了,你是打算三个…

阅读更多 →
200美金/月的ChatGPT Pro真的值吗? 2026/9/28 21:10:08

200美金/月的ChatGPT Pro真的值吗?

200 美金一个月的 ChatGPT Pro,我觉得最容易让人产生误判的地方,就是很多人会下意识拿它和 Plus 比“回答质量”。如果只是问问题、改改文章、翻译、偶尔让 ChatGPT 帮忙分析一下东西,那 Pro 很难给你一种“贵了十倍,所以聪明了十…

阅读更多 →
Eclipse Mosquitto 的 Snap 包安装、测试与配置完整指南 2026/9/28 21:10:08

Eclipse Mosquitto 的 Snap 包安装、测试与配置完整指南

物联网消息队列后端 【免费下载链接】mosquitto Eclipse Mosquitto - An open source MQTT broker 项目地址: https://gitcode.com/gh_mirrors/mosquit/mosquitto 点击查看 免费下载 Snap 是 Linux 发行版上分发与运行 Mosquitto MQTT 代理(broker&…

阅读更多 →
关于Java的初步认识以及与C语言的比较 2026/9/28 21:10:08

关于Java的初步认识以及与C语言的比较

前言Java 是一门面向对象、跨平台、安全稳定的高级编程语言,由 Sun Microsystems(后被 Oracle 收购)于 1995 年推出,凭借 “一次编写,到处运行” 的特性,成为企业级开发、移动开发、后端服务等领域的主流语…

阅读更多 →
图解 vLLM:从 Prefill 到 Decode,看懂 vLLM 的优化 2026/9/28 21:10:08

图解 vLLM:从 Prefill 到 Decode,看懂 vLLM 的优化

简介 在上一篇中,我们沿着一次模型调用,认识了输入处理、Prefill、KV Cache、Decode 和输出返回等环节。对于普通的自回归生成,模型需要先处理已有输入,再利用缓存逐步预测后续 token,最后由服务将生成结果转换成文本…

阅读更多 →
用OpenCV部署YOLOP:CPU也能实现驾驶感知三合一 2026/9/28 21:10:01

用OpenCV部署YOLOP:CPU也能实现驾驶感知三合一

简介:一套基于OpenCV DNN模块部署YOLOP全景驾驶感知网络的完整工程,面向自动驾驶、智能交通方向的CV开发者与嵌入式部署工程师。YOLOP可同时完成交通目标检测、可驾驶区域分割与车道线检测三项视觉感知任务,适用车载视觉感知、行车记录仪后处…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉