9Router 组合(Combos)实战指南:用自定义回退链构建 24/7 可用的 AI 编码路由

发布时间:2026/9/12 1:14:12
9Router 组合(Combos)实战指南:用自定义回退链构建 24/7 可用的 AI 编码路由 9Router 组合Combos实战指南用自定义回退链构建 24/7 可用的 AI 编码路由【免费下载链接】9routerUnlimited FREE AI coding. Connect Claude Code, Codex, Cursor, Cline, Copilot, Antigravity to FREE Claude/GPT/Gemini via 40 providers. Auto-fallback, RTK -40% tokens, never hit limits.项目地址: https://gitcode.com/GitHub_Trending/9r/9router组合Combo是 9Router 提供的**自定义回退链Custom Fallback Chain**机制你不必再绑定单一模型而是把多个模型按优先级排成一条链由 9Router 依次尝试直到请求成功为止。本指南以官方文档为核心结合仓库源码与仪表盘实现完整讲解组合的创建、使用、策略选择、底层回退判定逻辑与排障方法读完后你可以为 Cursor、Claude Desktop、Codex、Cline 等任意工具配置属于自己的成本—质量—可用性路由方案。组合是什么组合是你在仪表盘中创建的自定义回退链。它不是一个单一模型而是一组有序模型序列由 9Router 按顺序自动尝试直到某个模型成功响应。一个典型组合的定义如下组合名: premium-coding 模型: 1. cc/claude-opus-4-5-20251101 (首选) 2. glm/glm-4.7 (#1 配额耗尽时) 3. minimax/MiniMax-M2.1 (#2 配额耗尽时)在 CLI 工具中你只需要把Model字段填成组合名即可Model: premium-coding9Router 会按顺序自动尝试链上的每个模型直到成功为止。从源码结构看组合服务实现中的handleComboChat就是这条链的执行器它遍历组合内的每个模型依次调用handleSingleModel(body, modelStr)一旦某个模型返回 2xx 成功响应就立即返回结果否则把失败原因记录下来并尝试下一个。为什么使用组合组合的价值在于把成本、质量、可用性三个目标同时纳入一条路由链1. 最大化订阅价值cc/claude-opus → glm/glm-4.7 → if/kimi-k2-thinking → 先用订阅,低价备用,免费应急 → 充分利用你已付费的订阅2. 最小化成本glm/glm-4.7 → minimax/MiniMax-M2.1 → if/kimi-k2-thinking → 从最便宜的付费选项开始(每 1M $0.60) → 回退到更便宜的(每 1M $0.20) → 应急免费层 → 总成本: 约 $5-10/月(文档示例估算)3. 保障 24/7 可用cc/claude-opus → cx/gpt-5.2-codex → glm/glm-4.7 → if/kimi-k2-thinking → 末尾总是放免费层 → 永不耗尽配额 → 随时随地编码4. 质量优化cc/claude-opus-4-5 → cx/gpt-5.2-codex → gc/gemini-3-pro → 优先最好的模型 → 回退到其他高端模型 → 整个回退链保持高质量如何创建组合步骤 1打开仪表盘http://localhost:20128 → 用密码登录步骤 2进入组合页面仪表盘 → 组合 → 新建组合步骤 3配置组合组合名premium-coding描述(可选)订阅优先,低价备用,免费应急选择模型1. cc/claude-opus-4-5-20251101 2. glm/glm-4.7 3. minimax/MiniMax-M2.1拖动排序—— 自上而下表示优先级。仪表盘的组合管理页面/dashboard/combos/page.js)使用dnd-kit实现了拖拽排序同时每个模型项还提供上移/下移箭头与内联编辑方便不习惯拖拽时微调顺序。步骤 4保存点击 Save Combo → 组合出现在模型列表中步骤 5在 CLI 中使用Cursor/Cline/任意工具: Model: premium-coding保存后组合会通过 模型列表 API 暴露给所有兼容客户端该接口会先读取全部组合把每个组合作为一个独立模型项返回因此任何把 9Router 当作 OpenAI 兼容端点的工具都能直接在模型下拉框中看到组合名。组合的增删改查由 组合 APIGET/POST与 组合详情 APIPUT/DELETE支撑。需要说明的是组合名有格式约束仪表盘源码中通过正则/^[a-zA-Z0-9_.\-]$/校验只允许字母、数字、-、_、.命名时请避免空格与特殊字符。示例组合示例 1Premium Coding订阅 → 低价 → 免费目标最大化订阅价值,最小化额外成本。仪表盘 → 组合 → 新建 名称: premium-coding 模型: 1. cc/claude-opus-4-5-20251101 2. glm/glm-4.7 3. minimax/MiniMax-M2.1用法Cursor IDE: Model: premium-coding行为早上(全新配额): 请求 → cc/claude-opus-4-5 ✅ 下午(Claude 配额用完): 请求 → glm/glm-4.7 ✅ (自动切换) 晚上(GLM 配额用完): 请求 → minimax/MiniMax-M2.1 ✅ (自动切换)月成本示例(100M tokens文档示例估算)80M 通过 Claude Code: $0(订阅) 15M 通过 GLM: $9 5M 通过 MiniMax: $1 合计: $10 你的订阅示例 2Budget Combo低价 → 免费目标最小化成本,免费层作为备用。仪表盘 → 组合 → 新建 名称: budget-combo 模型: 1. glm/glm-4.7 2. minimax/MiniMax-M2.1 3. if/kimi-k2-thinking用法Cline: Provider: OpenAI Compatible Base URL: http://localhost:20128/v1 Model: budget-combo行为请求 → glm/glm-4.7 ✅ 每日配额可用 → 使用 GLM(每 1M $0.60) ❌ 配额耗尽 → 尝试 MiniMax(每 1M $0.20) ❌ MiniMax 配额用完 → 使用 iFlow(免费)示例 3Free Combo零成本目标100% 免费,永不付费。仪表盘 → 组合 → 新建 名称: free-combo 模型: 1. if/kimi-k2-thinking 2. qw/qwen3-coder-plus 3. kr/claude-sonnet-4.5用法Claude Desktop: Model: free-combo行为请求 → if/kimi-k2-thinking ✅ 可用 → 使用 iFlow ❌ 错误 → 尝试 Qwen ❌ 错误 → 尝试 Kiro适用场景个人项目、学习、试验。示例 4Quality First仅高端模型目标最高质量,无低价回退。仪表盘 → 组合 → 新建 名称: quality-first 模型: 1. cc/claude-opus-4-5-20251101 2. cx/gpt-5.2-codex 3. gc/gemini-3-pro-preview用法Codex CLI: export OPENAI_BASE_URLhttp://localhost:20128 Model: quality-first行为请求 → cc/claude-opus-4-5 ❌ 配额用完 → cx/gpt-5.2-codex ❌ 配额用完 → gc/gemini-3-pro-preview ❌ 全部用完 → 返回错误(无低价回退)适用场景关键生产代码、复杂重构。注意这条链没有免费兜底全部配额耗尽时 9Router 会返回错误——从handleComboChat的实现看所有模型都失败时会返回503 Service Unavailable并携带最早可用时间retryAfter而不是默认静默成功。示例 5Multi-Subscription用足所有订阅目标在产生额外费用前用足所有订阅。仪表盘 → 组合 → 新建 名称: multi-sub 模型: 1. gc/gemini-3-flash-preview (每月免费 180K) 2. cc/claude-opus-4-5-20251101 (Pro 订阅) 3. cx/gpt-5.2-codex (Plus 订阅) 4. gh/gpt-5 (Copilot 订阅) 5. glm/glm-4.7 (低价备用) 6. if/kimi-k2-thinking (免费应急)月成本示例(200M tokens文档示例估算)50M 通过 Gemini CLI: $0(免费层) 80M 通过 Claude Code: $0(订阅) 40M 通过 Codex: $0(订阅) 20M 通过 Copilot: $0(订阅) 8M 通过 GLM: $4.80 2M 通过 iFlow: $0 合计: $4.80 你已有的订阅示例 6配额重置优化目标根据重置时间分配使用。仪表盘 → 组合 → 新建 名称: reset-optimized 模型: 1. cc/claude-opus-4-5 (5h 重置, 早上用) 2. gc/gemini-3-flash (每日 1K, 下午用) 3. glm/glm-4.7 (每日 10AM 重置, 晚上用) 4. minimax/MiniMax-M2.1 (5h 滚动, 夜里用) 5. if/kimi-k2-thinking (无限, 应急)日常安排08:00 - 13:00: Claude Code(全新 5h 配额) 13:00 - 18:00: Gemini CLI(每日 1K 配额) 18:00 - 22:00: GLM(次日 10AM 重置) 22:00 - 08:00: MiniMax(5h 滚动)或 iFlow结果以极低成本实现 24/7 编码。各提供商的配额重置周期可参见智能路由文档中的配额重置策略章节。在 CLI 工具中使用组合Cursor IDESettings → Models → Advanced: OpenAI API Base URL: http://localhost:20128/v1 OpenAI API Key: [从仪表盘获取] Model: premium-codingClaude Desktop编辑~/.claude/config.json{ anthropic_api_base: http://localhost:20128/v1, anthropic_api_key: your-9router-api-key, model: budget-combo }Codex CLIexport OPENAI_BASE_URLhttp://localhost:20128 export OPENAI_API_KEYyour-9router-api-key codex --model quality-first your promptCline / Continue / RooCodeProvider: OpenAI Compatible Base URL: http://localhost:20128/v1 API Key: [从仪表盘获取] Model: free-comboAPI 请求curl http://localhost:20128/v1/chat/completions \ -H Authorization: Bearer your-api-key \ -H Content-Type: application/json \ -d { model: premium-coding, messages: [ {role: user, content: Write a function to...} ], stream: true }底层实现组合链如何判定回退理解了界面操作之后再看组合在运行时如何工作。核心逻辑集中在 组合服务实现 与 账户回退判定 两个文件中1. 失败判定checkFallbackErrorhandleComboChat在某个模型返回非 2xx 时会读取响应体中的error.message然后调用checkFallbackError(status, errorText)判断是否应该回退到下一个模型。判定规则来自 错误规则配置 中的ERROR_RULES自上而下匹配文本规则优先命中no credentials、rate limit、too many requests、quota exceeded、capacity、overloaded等关键字即触发回退其中限流类规则走指数退避BACKOFF_CONFIG基础 2s、上限 5 分钟、最大 15 级状态码规则401/402/403/404触发 2 分钟冷却429触发指数退避未匹配的任意错误默认按瞬时错误处理冷却 30 秒TRANSIENT_COOLDOWN_MS。2. 瞬时错误保护对于503/502/504这类瞬时错误如果冷却时间不超过 5 秒handleComboChat会先等待冷却窗口再继续下一个模型避免对短暂过载的提供商立刻跳过源码注释明确记录这是修复组合在瞬时 503 时直接穿透问题的逻辑。3. 全链失败的处理当链上所有模型都失败时9Router 会汇总最早可重试时间retryAfter返回503 Service Unavailable并附带人类可读的reset after Xm Ys提示见formatRetryAfter若错误信息包含no credentials也会统一映射为 503因为此时并非请求本身非法而是提供商暂不可用。4. 组合策略策略化路由仪表盘的组合管理页面/dashboard/combos/page.js)为每个组合提供了独立策略选择默认Fallback按序尝试另有三种高级策略Round Robin轮询在请求之间轮换模型以分散负载getRotatedModels按组合名维护内存中的轮转索引并通过comboStickyLimit控制同一模型连续服务几个请求后再切换默认 1Fusion融合把请求并行发给面板中的所有模型再由一个Judge 模型综合多份回答输出最终答案。handleFusionChat实现了达到最小面板数后等待迟到者宽限期默认 8s 面板硬超时默认 90s的收集策略面板回答会匿名化为[Source N]交给 Judge 做共识/矛盾/盲区分析后合成Capacity auto-switch能力自动切换reorderByCapabilitiesdetectRequiredCapabilities会扫描当前用户轮次中的图片、PDF 等输入把满足硬性能力vision/pdf/audioInput/videoInput的模型浮动到链首且不会丢弃任何模型从而保证多模态请求优先命中支持它的模型。策略通过settings.comboStrategies[comboName]持久化可在仪表盘每个组合卡片上直接切换并可为 Fusion 指定 Judge 模型。最佳实践1. 总是包含免费层✅ 好: cc/claude-opus → glm/glm-4.7 → if/kimi-k2-thinking ❌ 不好: cc/claude-opus → glm/glm-4.7 (无免费回退,可能耗尽配额)原因确保 24/7 可用绝不会被配额卡住。2. 按成本排序便宜 → 贵✅ 好: glm/glm-4.7 → minimax/MiniMax-M2.1 → cc/claude-opus ❌ 不好: cc/claude-opus → glm/glm-4.7 (在简单任务上浪费订阅配额)例外如果想充分利用订阅价值把订阅放在最前面。3. 匹配质量要求生产代码: cc/claude-opus → cx/gpt-5.2-codex → glm/glm-4.7 简单任务: glm/glm-4.7 → if/kimi-k2-thinking 试验: if/kimi-k2-thinking → qw/qwen3-coder-plus4. 考虑配额重置时间早上组合(配额刚刷新): cc/claude-opus → cx/gpt-5.2-codex 晚上组合(配额大概率耗尽): glm/glm-4.7 → minimax/MiniMax-M2.1 → if/kimi-k2-thinking5. 为不同场景创建多个组合premium-coding: 复杂任务 budget-combo: 简单任务 free-combo: 试验 quality-first: 生产代码根据任务需求切换组合。6. 监控组合性能仪表盘 → 分析 → 组合使用: premium-coding: 80% 通过 cc/claude-opus(良好,使用订阅) 15% 通过 glm/glm-4.7(可接受备用) 5% 通过 minimax(罕见回退)优化回退使用过多时提高主配额或重新排序模型。高级配置为组合设置预算上限仪表盘 → 组合 → 编辑 → 预算: 每日上限: $5 每月上限: $50达到上限时9Router 跳过付费模型仅使用免费层。启用/禁用组合中的模型仪表盘 → 组合 → 编辑 → 模型: ✅ cc/claude-opus-4-5(启用) ❌ glm/glm-4.7(暂时禁用) ✅ if/kimi-k2-thinking(启用)用途暂时禁用昂贵模型而不删除组合。克隆已有组合仪表盘 → 组合 → 克隆 premium-coding → 生成带 -copy 后缀的副本 → 修改后另存为新组合用途为不同场景创建变体。故障排除问题组合未出现在模型列表中方案刷新仪表盘检查组合已保存绿色对勾重启 CLI 工具以刷新模型列表问题组合总是用最后一个模型免费层方案检查主模型的配额仪表盘 → 配额确认 API keys 有效仪表盘 → 提供商检查是否超出预算上限问题组合成本超出预期方案仪表盘 → 分析 → 查看组合使用情况检查主模型是否配额耗尽重新排序模型更便宜的放前面设置预算上限相关智能路由 —— 自动回退如何工作含三阶回退体系与配额重置周期表配额跟踪 —— 监控使用与成本【免费下载链接】9routerUnlimited FREE AI coding. Connect Claude Code, Codex, Cursor, Cline, Copilot, Antigravity to FREE Claude/GPT/Gemini via 40 providers. Auto-fallback, RTK -40% tokens, never hit limits.项目地址: https://gitcode.com/GitHub_Trending/9r/9router创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询