渠道配置
管理后台 → 大模型 → 渠道管理
渠道是平台与上游供应商之间的接入配置:供应商类型 + Base URL + 凭证。请求到达网关后,调度引擎从声明了对应模型能力、且健康可用的渠道中选择一条转发路径,异常时自动切换。接入新供应商只需在此创建渠道,无需改动代码。

支持的供应商
渠道类型覆盖 30+ 供应商:OpenAI、Claude (Anthropic)、Gemini (Google)、Ali(百炼)、Tencent(混元)、Zhipu(智谱)、DeepSeek、Moonshot、Volcengine(火山)、AWS Bedrock、Azure OpenAI、Vertex AI、Mistral、xAI (Grok)、Lingyi(零一万物)、Baidu V2、Cloudflare Workers AI、Ollama、SiliconFlow(硅基流动)、Xunfei(讯飞)、OpenRouter、XInference、MiniMax、Submodel、Coze(扣子)、Dify、Jimeng(即梦)、Codex、New API、Sub2API 等。
其中 Ollama / XInference 等本地推理框架与云端模型同池调度,适合混合部署。
创建渠道
渠道管理 → 创建渠道,表单分为三段:
基础信息
| 字段 | 说明 |
|---|---|
| 渠道名称 | 自定义,便于识别,如「OpenAI 主力」 |
| 供应商类型 | 决定协议适配方式,可搜索选择 |
| Base URL | 上游地址。留空自动使用该供应商的官方默认地址;中转商填其分发地址 |
| API Key | 上游密钥,必填。加密存储,不落明文(见安全说明) |
调度与容量
| 字段 | 默认值 | 说明 |
|---|---|---|
| 调度层级 | 首选 | 三档固定层级:首选(承接主要流量)/ 备用(零星保温流量,主力饱和时溢出承接)/ 保底(仅前两层不可用时使用) |
| 权重 | 100 | 0–100,同层级内按权重比例分配流量 |
| 最大并发 | 100 | 0 = 自动估算(按上游 429 水位动态调整) |
| 严格容量 | 关 | Redis 故障时保守限流(fail-closed),高成本渠道建议开启 |
| 状态 | 启用 | 启用 / 禁用 / 测试中(测试中不参与正式调度) |
| 测试模型 | — | 渠道测试用的默认模型,如 gpt-4o-mini |
| 使用代理 | 关 | 开启后该渠道经全局出站代理转发(需先在系统设置 → 渠道配置配置代理地址) |
| 备注 | — | 选填 |
VIP 设置(折叠面板)
面向「VIP 专属渠道」的运营玩法:开启 VIP 渠道 后,可配置共享阈值(低于该健康分的非 VIP 租户不进入)、抢占阈值与借用冷却(秒)(非 VIP 租户借用后被释放的冷却时间),让高价值租户优先使用优质渠道。
官方渠道授权
对 Claude、OpenAI、Codex、Gemini 官方账号,可免手工粘贴 Key,直接走 OAuth 授权创建渠道:
- Claude 支持两种模式:浏览器授权(生成授权链接 → 登录并授权 → 把回调 URL 中的
code粘贴回后台换取令牌)与 Cookie 授权(粘贴 claude.ai 的 sessionKey 直接完成);授权范围可选完整权限或仅推理; - OpenAI / Codex / Gemini 走标准授权链接流程。
授权成功后渠道自动创建,令牌由平台托管并自动续期。
渠道列表
列表按渠道 ID、类型、模型名、状态、地址、名称筛选,支持导出 CSV / Excel。关键列与操作:
| 列 / 操作 | 说明 |
|---|---|
| 层级 / 权重 | 行内直接编辑,改完即时保存,用于实时调流 |
| 健康度 | 0–100 分:≥80 健康(绿)、50–79 降级(黄)、<50 故障(红) |
| 调度状态 | 正常 / 熔断 / 半开,详见健康度与熔断 |
| 启用 / 禁用 | 快捷开关,禁用后立即退出调度 |
| 重置健康度 | 熔断复位 + 成功率恢复,渠道立即恢复被调度的资格(上游修复后用它立刻拉起) |
| 详情 | 进入渠道详情 |
| 删除 | 二次确认后删除渠道及其 Key、模型能力 |
调度规则
页面顶部的「了解优先级、权重、亲和与容量如何共同调度」内置于产品,规则概要:
- 候选筛选 —— 只在「已启用 + 支持当前模型 + 符合租户范围 + 存在可用 Key」的渠道中选择;健康度低于 20 的渠道通常被排除,若全部低于 20 则保留作降级候选。
- 层级与权重 —— 仅最高可用层级的渠道组参与分配;同组内按权重建立分流,
权重=0不参与调度;健康度 50–79 时有效权重减半,20–49 降至 1/4。 - 渠道亲和 —— 同一「租户 + 用户 + API Key + 模型」的请求尽量复用同一渠道(默认 30 分钟,成功即刷新),提高上游缓存命中率、避免上下文漂移。
- 故障与容量 —— 亲和渠道硬失败时清除绑定并重新选路;渠道达到并发上限时仅当前请求临时溢出到其他渠道,不覆盖原亲和。
典型布局:主力供应商设「首选」,同层级多条渠道按 7:3 权重分流;备用中转设「备用」保温;兜底的高价渠道设「保底」——主力故障时流量逐层下泄,业务无感。
调度引擎的精细参数(层级权重因子、熔断阈值等)可通过系统设置 → 渠道配置的路由策略 JSON 覆盖。
渠道详情
点击「详情」进入单渠道管理页,顶部支持克隆渠道(快速复制配置 + 新 Key)、禁用 / 启用与删除。
基本信息
渠道全量参数的展示与编辑,以及渠道 Key 列表:
- 每条凭证显示类型(API Key / OAuth)与状态;
- 凭证冷却:Key 因上游 401/403(密钥无效、账户额度不足)被调度器临时停用,页面显示剩余秒数,到期自动恢复;全部 Key 同时冷却时该渠道暂不可用;
- 更新 Key:密钥轮换时直接替换;
- 克隆渠道:复用现有配置新建渠道,适合「同一供应商多账号」场景。
模型能力
声明该渠道能服务哪些平台模型,是模型目录与上游的连接点:
| 字段 | 说明 |
|---|---|
| 平台模型名 | 从模型列表选择,即对外的模型标识 |
| 上游模型名 | 实际请求上游时使用的名称。留空则与平台模型名相同;上游命名不同时才填(如平台 gpt-4 → 上游 gpt-4-0314) |
| 成本比例 | 该渠道相对基准价的成本系数(1.0 为标准)。<1 更便宜、多渠道择优时更优先;>1 更贵、优先级降低。只影响调度选择,不影响对用户的计费 |
| Responses 协议 | 声明该模型在上游支持 OpenAI Responses API:/v1/responses 请求直连上游原生协议转发,且调度时优先选择此类渠道 |
| Chat 经 Responses | 上游仅有 Responses 协议(responses-only,如 Codex 类中转)时开启:/v1/chat/completions 请求自动桥接转换到 /v1/responses |
| 状态 | 单模型粒度的启用 / 禁用 |
| 健康状态 / 熔断 | 模型级健康分与熔断状态,异常时可对单个模型「重置健康」 |
同一平台模型在多条渠道上都添加能力,即可获得冗余与分流——这正是「模型与渠道解耦」的用法。
测试
以指定模型向该渠道发一条真实对话请求,返回延迟、模型回复内容与 Token 用量,用于验证渠道连通性与协议适配。当前仅支持文本对话类模型。
健康趋势
近 24 小时(可切换时间窗)的健康度曲线 + 延迟柱状图,50 分处有虚线参考线,用于判断渠道质量是抖动还是持续劣化。
调试日志
抓取该渠道的完整四段报文,是协议对接与争议排查的利器:
- 客户端 → 系统(原始请求)
- 系统 → 上游(协议转换后,凭证已脱敏)
- 上游 → 系统(响应原文)
- 系统 → 客户端(协议转换后)
使用方式:
- 在基本信息中开启调试日志开关后,新请求开始记录;
- 可设置捕捉目标:按「租户 → 成员 → 密钥」逐级缩小范围,只抓指定调用方的流量;
- 列表按 Request ID、模型名、仅看错误、日期区间检索,详情展示状态码、各段耗时、首字延迟、协议转换链路等元信息。
WARNING
调试日志记录完整请求与响应体,体积大且可能包含业务敏感数据——排查完成后及时关闭,并按数据治理的策略清理历史数据。
健康度与熔断
| 调度状态 | 含义 |
|---|---|
| 正常 | 常规调度 |
| 熔断 | 渠道(或某模型)被调度器硬排除,请求路由到其他渠道;上游修复后可「重置健康度」立即复位 |
| 半开 | 冷却期已过,按窗口放行少量真实请求探活,探测成功即自动闭合 |
配合两项自动化策略(默认关闭/开启状态见系统设置 → 渠道配置):
- 渠道自动探测 —— 定期向活跃渠道发测试请求更新健康度(消耗少量 Token);
- 渠道自动禁用 —— 熔断持续超时未恢复时自动禁用渠道,避免坏渠道反复进出调度。
渠道级错误明细与告警见运维监控的「渠道错误监控」与「告警规则」页面。
相关文档
- 模型配置 —— 平台模型目录与基准定价
- 系统设置 → 渠道配置 —— 自动探测 / 自动禁用 / 路由策略 / 代理 / 协议转换
- 架构概览 · 渠道健康与故障转移 —— 调度引擎设计
- 排障指南 —— Request ID 全链路排查